Mercury 2
Inception🇺🇸
inception/mercury-2Mercury 2 is Inception Labs' diffusion-based LLM that generates responses in parallel rather than token-by-token, delivering very high throughput (1000+ tokens/second) with a 128K context window. It offers tunable reasoning and native tool use, matching Claude Haiku/Gemini Flash-class quality at much faster speeds and lower cost, ideal for latency-sensitive agentic and coding tasks.
Тариф стоимости
0.2x
Контекст
128K
Выпуск
4 мар. 2026 г.
Ввод
Text
Вывод
Text
Поддержка
РассуждениеВызов инструментовСтруктурированный вывод
Сильные стороны
Категории, в которых эта модель показывает лучшие результаты.
Программное обеспечение и ИТ-услуги
#219 · топ 53%
Развлечения, спорт и медиа
#219 · топ 53%
Бизнес, менеджмент и финансы
#227 · топ 56%
Медицина и здравоохранение
#242 · топ 63%
Производительность
Медианные задержка и пропускная способность, измеренные по недавним запросам.
Пропускная способность697 tok/s
Задержка