π§
Donorsim Qwen3 8b Reinforce Verl model by 3l3ktr4
β 36.3
π¬Technical Deep Dive
Full Specifications [+]
π Updated daily
Source summary: Based on Hugging Face metadata. Not a recommendation.
π‘οΈ Model Transparency Report
Technical metadata sourced from upstream repositories.
Open Metadata
π Identity & Source
- id
- hf-model--3l3ktr4--donorsim-qwen3-8b-reinforce-verl
- slug
- 3l3ktr4--donorsim-qwen3-8b-reinforce-verl
- source
- huggingface
- author
- 3l3ktr4
- tags
- transformers, safetensors, qwen3, text-generation, reinforcement-learning, game-theory, cooperation, donor-game, verl, reinforce-plus-plus, base_model:qwen/qwen3-8b, base_model:finetune:qwen/qwen3-8b, text-generation-inference, endpoints_compatible, region:us
βοΈ Technical Specs
- architecture
- Qwen3ForCausalLM
- params billions
- 8
- context length
- 32,768
- pipeline tag
- reinforcement-learning
- vram gb
- 8.5
- vram is estimated
- true
- vram formula
- VRAM β (params * 0.75) + 2GB (KV) + 0.5GB (OS)
π Engagement & Metrics
- downloads
- 3
- stars
- 0
- forks
- 0
Data indexed from public sources. Updated daily.