Nellyw888/VeriReason-Qwen2.5-3b-RTLCoder-Verilog-GRPO-reasoning-tb download history

Nellyw888/VeriReason-Qwen2.5-3b-RTLCoder-Verilog-GRPO-reasoning-tb is a 3.1B-parameter reinforcement learning model by Nellyw888. In the last 30 days it was downloaded 46 times (5 in the last 7 days), and 1,445 times in total.

It ranks #261,613 on the Hub by monthly downloads and #2,834 among reinforcement learning models.

It has 1 likes.

It is a fine-tune of Qwen/Qwen2.5-Coder-3B.

2 models build on VeriReason-Qwen2.5-3b-RTLCoder-Verilog-GRPO-reasoning-tb: 2 quantized, 0 fine-tuned, 0 adapters and 0 merges. Together with the original they were downloaded 1,034 times in the last 30 days. See the VeriReason-Qwen2.5-3b-RTLCoder-Verilog-GRPO-reasoning-tb galaxy.

Most downloaded derivatives

Open Nellyw888/VeriReason-Qwen2.5-3b-RTLCoder-Verilog-GRPO-reasoning-tb on Hugging Face