3 3 days ago

qwen3.6:35b-512k-bf16

vision tools thinking
ollama run home-rag/qwen3.6:35b-512k-bf16

Applications

Claude Code
Claude Code ollama launch claude --model home-rag/qwen3.6:35b-512k-bf16
OpenCode
OpenCode ollama launch opencode --model home-rag/qwen3.6:35b-512k-bf16
Hermes Agent
Hermes Agent ollama launch hermes --model home-rag/qwen3.6:35b-512k-bf16
OpenClaw
OpenClaw ollama launch openclaw --model home-rag/qwen3.6:35b-512k-bf16

Models

View all →

Readme

Qwen 3.6 35B A3B MoE

ARCH: QWEN_3.5_MOE // PARAMS: 35B // PRECISION: BF16 // CONTEXT: 512K TOKENS

Hardware & Environment

Designed for local multi-GPU systems and small GPU grids.

  • Target hardware: AMD Instinct MI50, MI60, MI100 and MI210 series
  • Recommended memory: 112+ GB HBM / VRAM

Technical Specifications

  • Model: Qwen 3.6 35B A3B MoE
  • Origin: Hugging Face Qwen/Qwen3.6-35B-A3B
  • Precision: BF16
  • Vision: Integrated mmproj (archclip) for multimodal input
  • Acceleration: Multi-Token Prediction (MTP) draft head
  • Context: Up to 524288 tokens

Quick Start

ollama run --think=high home-rag/qwen3.6:35b-512k-bf16