Granite 3.3 8B (Non-reasoning)
IBMओपन वेटApache 2.0 · व्यावसायिक उपयोग
विवरण
Granite-3.3-8B-Base is a decoder-only language model with a 128K token context window. It improves upon Granite-3.1-8B-Base by adding support for Fill-in-the-Middle (FIM) using specialized tokens, enabling the model to generate content conditioned on both prefix and suffix. This makes it well-suited for code completion tasks
रिलीज़ तिथि
2025-04-16
पैरामीटर
8.2B
संदर्भ लंबाई
—
मोडैलिटीज़
text
क्षमता रडार
16
general
12
coding
18
reasoning
20
scienceअनुमानित
16
agents
0
multimodal
समर्पित विज्ञान बेंचमार्क उपलब्ध न होने पर Science तर्क प्रॉक्सी का उपयोग करके अनुमान लगाता है।
रैंकिंग
| डोमेन | #रैंक | स्कोर | स्रोत |
|---|---|---|---|
| कोडिंग रैंकिंग | 467 | 7.0 | AA |
| सामान्य रैंकिंग | 484 | 15.0 | AA |
| गणितीय तर्क | 314 | 18.0 | AA |
| तर्क | 26 | 83.0 | LS |
| विज्ञान | 460 | 17.0 | AA |
बेंचमार्क स्कोर (LLM Stats)
Code
HumanEval
89.7%स्वयं
Creativity
AlpacaEval 2.0
62.7%स्वयं
Arena Hard
57.6%स्वयं
Finance
MMLU
63.9%स्वयं
TruthfulQA
52.1%स्वयं
General
TriviaQA
78.2%स्वयं
IFEval
74.8%स्वयं
ARC-C
50.8%स्वयं
AGIEval
49.3%स्वयं
NQ
36.5%स्वयं
PopQA
26.2%स्वयं
Language
Winogrande
74.4%स्वयं
BIG-Bench Hard
69.1%स्वयं
Math
AIME 2024
81.2%स्वयं
MATH-500
69.0%स्वयं
GSM8k
59.0%स्वयं
DROP
36.1%स्वयं
Reasoning
HumanEval+
86.1%स्वयं
HellaSwag
80.1%स्वयं
Safety
AttaQ
88.5%स्वयं
AA मूल्यांकन सूचकांक
Math Index6.7
Intelligence Index1.8
Math 5000.7
Mmlu Pro0.5
Gpqa0.3
Ifbench0.2
Livecodebench0.1
Tau20.1
Scicode0.1
Aime 250.1
Aime0.0
Lcr0.0
Hle0.0
Terminalbench Hard0.0
LLM Stats श्रेणी स्कोर
Safety90
Code90
Structured Output70
Instruction Following70
Language70
Math60
Reasoning60
Legal60
Finance60
General60
Healthcare60
Creativity60
Writing60
मूल्य निर्धारण
इनपुट मूल्य$0.03 / 1M टोकन
आउटपुट मूल्य$0.25 / 1M टोकन
मिश्रित मूल्य (3:1)$0.085 / 1M टोकन
गति
टोकन/सेकंड362.0
पहले टोकन में देरी20.57s
पहले उत्तर में देरी20.57s
प्रदाता मूल्य रैंकिंग
प्रदाता मूल्य रैंकिंग
1 प्रदाता
प्रदाताइनपुटआउटपुट
1IBMप्राथमिक
$0.03
$0.25
इस मॉडल के लिए विभिन्न API प्रदाताओं के मूल्य निर्धारण की तुलना करें।