Перейти к основному содержанию

Nova 2 Omni

AmazonAmazonProprietary

Описание

Amazon Nova 2 Omni is Amazon's first unified multimodal reasoning model that processes text, documents, images, video, and audio inputs and generates both text and images from a single model, eliminating multi-model coordination complexity. It delivers strong multimodal perception, core reasoning, agentic tool use, and high-quality image generation and editing, with configurable extended thinking. It supports a 1M token context window, 200+ languages for text, and 10 languages for speech input.

Дата выхода
2025-12-02
Параметры
Длина контекста
Модальности

Радар способностей

70
general
0
coding
90
reasoning
68
scienceоцен.
70
agents
80
multimodal

При отсутствии специализированных научных бенчмарков Science оценивается по научным категориям LLM Stats или на основе рассуждений.

Рейтинги

Домен#МестоОценкаИсточник
Агентные возможности52
47.0
LS
Мультимодальный рейтинг97
34.0
LS

Оценки бенчмарков (LLM Stats)

(LLM Stats (zeroeval))

Audio

MMAU75.3%Сам.
CoVoST240.7%Сам.

Chat

Multi-Challenge75.5%Сам.
Tau2 Airline68.8%Сам.

Communication

Tau2 Telecom80.0%Сам.
Tau2 Retail78.3%Сам.

Instruction Following

IFBench68.7%Сам.

Language

MMLU-Pro80.7%Сам.

Math

AIME 202592.1%Сам.

Multimodal

RefCOCOg86.3%Сам.
Video-MME77.9%Сам.
QVHighlights76.7%Сам.
MAVERIX66.6%Сам.
RealKIE-FCC59.8%Сам.

Tool Calling

BFCL-V458.3%Сам.

Vision

ScreenSpot85.4%Сам.
MMMU-Pro61.4%Сам.
OCRBench_V258.2%Сам.

Индексы оценки AA

(Artificial Analysis)

Нет данных AA оценки

Оценки категорий LLM Stats

(LLM Stats (zeroeval))
Math
90
Spatial Reasoning
90
Grounding
90
Legal
80
Reasoning
80
Finance
80
Healthcare
80
Communication
80
Video
80
Chat
70
Multimodal
70
Instruction Following
70
General
70
Tool Calling
70
Vision
70
Language
60
Image To Text
60
Document Understanding
60
Agents
60
Audio
60
Speech To Text
40

Цены

Нет данных о ценах

Скорость

Нет данных о скорости

Рейтинг цен провайдеров

Нет данных провайдеров

Внешние ссылки