Mercury 2
Inception🇺🇸
inception/mercury-2Mercury 2 is Inception Labs' diffusion-based LLM that generates responses in parallel rather than token-by-token, delivering very high throughput (1000+ tokens/second) with a 128K context window. It offers tunable reasoning and native tool use, matching Claude Haiku/Gemini Flash-class quality at much faster speeds and lower cost, ideal for latency-sensitive agentic and coding tasks.
معدل التكلفة
0.2x
السياق
128K
تاريخ الإصدار
4 مارس 2026
الإدخال
Text
الإخراج
Text
الدعم
الاستدلالاستدعاء الأدواتالمخرجات المُهيكلة
أفضل ما يبرع فيه
الفئات التي يحتل فيها هذا النموذج أعلى المراتب.
البرمجيات وخدمات تقنية المعلومات
#219 · أفضل 53%
الترفيه والرياضة والإعلام
#219 · أفضل 53%
الأعمال والإدارة والتمويل
#227 · أفضل 56%
الطب والرعاية الصحية
#242 · أفضل 63%
الأداء
متوسط زمن الاستجابة والإنتاجية مقاسان عبر الطلبات الأخيرة.
الإنتاجية697 tok/s
زمن الاستجابة