Ranking

#wisdom #ai #llm

Jetzt das aktualisierte Ranking mit Qwen3.6-35B-A3B:

---

Aktualisiertes Ranking — OpenRouter, 100 Anfragen (mittlere Komplexität)

Annahmen: 3000 Input-Token + 2000 Output-Token (ohne Thinking) / 6000 Output-Token (mit Thinking)

#ModellInput /1MOutput /1MKosten 100 AnfragenThinkingKontext

---

Was macht Qwen3.6-35B-A3B besonders?

Es ist ein MoE-Modell mit 35B Gesamtparametern aber nur 3B aktiven Parametern pro Token — dadurch sehr effiziente Inferenz bei einem 262K-Token-Kontextfenster.

Das Modell denkt standardmässig im Thinking-Modus und bewahrt Reasoning-Kontext über mehrere Gesprächsrunden hinweg — relevant für komplexe mehrstufige Analysen.

---

Fazit für dich

Qwen3.6-35B-A3B ist teurer als Qwen3 32B, bietet aber doppeltes Kontextfenster (262K) und multimodale Fähigkeiten (Text + Bild). Für lange juristische Dokumente wie Bundesgerichtsentscheide oder umfangreiche Schriftsätze kann das relevant sein. Für Standardanalysen bleibt Qwen3 32B das bessere Preis-Leistungs-Verhältnis.

---------------------
1**Qwen3 32B** (kein Thinking)$0.08$0.28**$0.08**optional131K
2**Qwen3 32B** (mit Thinking)$0.08$0.28**$0.19**optional131K
3**Qwen3.6 35B-A3B** (kein Thinking)$0.15$1.00**$0.25**optional262K
4**Qwen3.6 35B-A3B** (mit Thinking)$0.15$1.00**$0.65**optional262K
5**DeepSeek V3.2**$0.25$0.38**$0.83**nein131K
6**DeepSeek R1**$0.70$2.50**$1.71**immer163K
7**Qwen3 Max**$0.78$3.90**$2.57**ja262K