Mercury 2
Inception🇺🇸
inception/mercury-2Mercury 2 is Inception Labs' diffusion-based LLM that generates responses in parallel rather than token-by-token, delivering very high throughput (1000+ tokens/second) with a 128K context window. It offers tunable reasoning and native tool use, matching Claude Haiku/Gemini Flash-class quality at much faster speeds and lower cost, ideal for latency-sensitive agentic and coding tasks.
Mức chi phí
0.2x
Ngữ cảnh
128K
Phát hành
4 thg 3, 2026
Đầu vào
Text
Đầu ra
Text
Hỗ trợ
Suy luậnGọi công cụĐầu ra có cấu trúc
Thế mạnh
Các danh mục mà mô hình này xếp hạng cao nhất.
Phần mềm & Dịch vụ CNTT
#219 · top 53%
Giải trí, Thể thao & Truyền thông
#219 · top 53%
Kinh doanh, Quản lý & Tài chính
#227 · top 56%
Y học & Chăm sóc sức khỏe
#242 · top 63%
Hiệu năng
Độ trễ và thông lượng trung vị được đo trên các yêu cầu gần đây.
Thông lượng697 tok/s
Độ trễ