opengates
← Назад к моделям
Iinception

Inception: Mercury 2

Mercury 2 — это чрезвычайно быстрая LLM для рассуждений и первая диффузионная LLM (dLLM) для рассуждений. Вместо последовательной генерации токенов Mercury 2 производит и уточняет несколько токенов параллельно, достигая скорости >1000 токенов/сек на стандартных GPU. Mercury 2 в 5 раз быстрее, чем ведущие LLM, оптимизированные по скорости, такие как Claude 4.5 Haiku и GPT 5 Mini, при значительно меньшей стоимости. Mercury 2 поддерживает настраиваемые уровни рассуждений, контекст 128K, нативное использование инструментов и вывод JSON, соответствующий схеме. Создан для рабочих процессов кодирования, где задержка накапливается, голосового поиска/поиска в реальном времени и циклов агентов. Совместим с OpenAI API. Подробнее читайте в блоге.

Цены

Input

20 ₽

$0.200000 за 1M токенов

Output

60 ₽

$0.600000 за 1M токенов

Характеристики

Контекстное окно

128K

128 000 токенов

Макс. выход

50K

50 000 токенов

Модальности

Вход:

📝 text

Выход:

📝 text

Возможности

▶ Streaming

Поддерживаемые параметры

Frequency PenaltyLogit BiasLogprobsMax TokensMin PPresence PenaltyRepetition PenaltyResponse FormatSeedStop SequencesStructured OutputsTemperatureTop KTop LogprobsTop P

Информация

Провайдер: inception
Категория: chat
ID модели:inception/mercury-2
Дата создания: 23 июля 2026 г.

Готовы начать?

Используйте эту модель через API или в веб-чате