Qwen3.5 35B A3B (Non-reasoning)
AlibabaQwenओपन वेटApache 2.0 · व्यावसायिक उपयोग
विवरण
Qwen3.5-35B-A3B is a multimodal Mixture-of-Experts model with 35 billion total parameters and 3 billion activated parameters. It combines strong reasoning, coding, agentic, and visual understanding performance with production-friendly efficiency and a native 262K context window.
रिलीज़ तिथि
2026-02-24
पैरामीटर
35.0B
संदर्भ लंबाई
262K
मोडैलिटीज़
audio, image, text, video
क्षमता रडार
22
general
36
coding
82
reasoning
50
science
60
agents
80
multimodal
रैंकिंग
| डोमेन | #रैंक | स्कोर | स्रोत |
|---|---|---|---|
| एजेंटिक क्षमता | 96 | 40.0 | LS |
| कोडिंग रैंकिंग | 256 | 46.0 | AA |
| सामान्य रैंकिंग | 226 | 52.0 | AA |
| मल्टीमॉडल रैंकिंग | 45 | 47.0 | LS |
| विज्ञान | 227 | 52.0 | AA |
बेंचमार्क स्कोर (LLM Stats)
(LLM Stats (zeroeval))3d
SUNRGBD
0.33 / 100स्वयं
Hypersim
0.13 / 100स्वयं
Agents
t2-bench
81.2%स्वयं
AndroidWorld_SR
71.1%स्वयं
BFCL-V4
67.3%स्वयं
BrowseCompOpenAI (2025)
61.0%स्वयं
FullStackBench en
58.1%स्वयं
WideSearch
57.1%स्वयं
TIR-Bench
55.5%स्वयं
FullStackBench zh
55.0%स्वयं
OSWorld-Verified
54.5%स्वयं
Terminal-Bench 2.0Stanford × Laude Institute (2026)
40.5%स्वयं
VITA-Bench
31.9%स्वयं
DeepPlanning
22.8%स्वयं
Biology
GPQANYU + Cohere + Anthropic (2023)
84.2%स्वयं
Chemistry
SuperGPQA
63.4%स्वयं
Code
SWE-Bench Verified
69.2%स्वयं
Communication
Multi-Challenge
60.0%स्वयं
Embodied
EmbSpatialBench
0.83 / 100स्वयं
Finance
MMLU-Pro
85.3%स्वयं
MMLU-ProX
81.0%स्वयं
General
MMLU-Redux
93.3%स्वयं
IFEvalGoogle Research (2023)
91.9%स्वयं
C-Eval
90.2%स्वयं
MAXIFE
86.6%स्वयं
Global PIQA
86.6%स्वयं
MMMLU
85.2%स्वयं
MMStar
81.9%स्वयं
MMMU
81.4%स्वयं
Include
79.7%स्वयं
MMMU-Pro
75.1%स्वयं
LiveCodeBench v6
74.6%स्वयं
IFBench
70.2%स्वयं
LongBench v2
59.0%स्वयं
SimpleVQA
0.58 / 100स्वयं
NOVA-63
57.1%स्वयं
Grounding
RefCOCO-avg
0.89 / 100स्वयं
ScreenSpot Pro
68.6%स्वयं
RefSpatialBench
0.64 / 100स्वयं
Healthcare
VideoMMMU
80.4%स्वयं
SlakeVQA
78.7%स्वयं
PMC-VQA
62.0%स्वयं
MedXpertQA
61.4%स्वयं
Image To Text
OCRBench
91.0%स्वयं
Language
LingoQA
79.2%स्वयं
WMT24++
76.3%स्वयं
Long Context
MLVU
85.6%स्वयं
LVBench
71.4%स्वयं
MMLongBench-Doc
0.59 / 100स्वयं
AA-LCR
58.5%स्वयं
Math
HMMT25
89.2%स्वयं
HMMT 2025
89.0%स्वयं
MathVista-Mini
86.2%स्वयं
DynaMath
85.0%स्वयं
MathVision
83.9%स्वयं
CodeForces
0.82 / 3000स्वयं
PolyMATH
64.4%स्वयं
Humanity's Last Exam
47.4%स्वयं
Multimodal
VLMsAreBlind
97.0%स्वयं
V*
92.7%स्वयं
AI2D
92.6%स्वयं
MMBench-V1.1
91.5%स्वयं
OmniDocBench 1.5
89.3%स्वयं
VideoMME w sub.
86.6%स्वयं
VideoMME w/o sub.
82.5%स्वयं
CC-OCR
80.7%स्वयं
CharXiv-R
77.5%स्वयं
MVBench
74.8%स्वयं
MMVU
72.3%स्वयं
BabyVision
38.4%स्वयं
ZEROBench-Sub
0.34 / 100स्वयं
Nuscene
14.6%स्वयं
ZEROBench
0.08 / 100स्वयं
Reasoning
CountBench
0.98 / 100स्वयं
BrowseComp-zh
69.5%स्वयं
Hallusion Bench
67.9%स्वयं
ERQA
64.8%स्वयं
Seal-0
41.4%स्वयं
OJBench
36.0%स्वयं
Spatial Reasoning
RealWorldQA
84.1%स्वयं
Vision
ODinW
42.6%स्वयं
AA मूल्यांकन सूचकांक
(Artificial Analysis)Coding Index(Artificial Analysis)37.0
Intelligence Index(Artificial Analysis)24.3
Tau2(Sierra + U Toronto + Vector Institute (2025))0.9
Gpqa(NYU + Cohere + Anthropic (2023))0.8
Lcr(Artificial Analysis)0.6
Ifbench(Google Research (2023))0.4
Terminalbench V2 10.4
Scicode(UIUC + Argonne National Lab (2024))0.3
Hle(Center for AI Safety + Scale AI (2025))0.1
Terminalbench Hard(Stanford × Laude Institute (2026))0.1
Tau Banking0.0
LLM Stats श्रेणी स्कोर
(LLM Stats (zeroeval))Legal80
Math80
Physics80
Structured Output80
Image To Text80
Instruction Following80
Language80
Embodied80
Finance80
Biology80
Text-to-image80
Video80
Long Context70
Multimodal70
Reasoning70
Spatial Reasoning70
Frontend Development70
General70
Grounding70
Healthcare70
Chemistry70
Vision70
Search60
Code60
Communication60
Economics60
Tool Calling60
Agents50
3d20
Spatial10
मूल्य निर्धारण
इनपुट मूल्य$0.25 / 1M टोकन
आउटपुट मूल्य$2 / 1M टोकन
मिश्रित मूल्य (3:1)$0.688 / 1M टोकन
गति
टोकन/सेकंड161.3
पहले टोकन में देरी1.21s
पहले उत्तर में देरी1.21s
प्रदाता मूल्य रैंकिंग
प्रदाता मूल्य रैंकिंग
1 प्रदाता
प्रदाताइनपुटआउटपुट
1Alibabaप्राथमिक
$0.25
$2
इस मॉडल के लिए विभिन्न API प्रदाताओं के मूल्य निर्धारण की तुलना करें।