Реклама
Перетяжка // Коробка 3.0

Inception выпустила диффузионную модель Mercury 2.5

По данным Inception, Mercury 2.5 выдаёт 1 107 токенов в секунду и поддерживает контекст на 260 тысяч токенов. Модель доступна через Inception API, Baseten и OpenRouter.

Обложка: Inception выпустила диффузионную модель Mercury 2.5

8 сентября 2026 года Inception выпустила Mercury 2.5, быструю и недорогую языковую модель для поиска, RAG-систем, голосовых агентов и других задач с множеством вызовов. По оценке разработчика, новая версия на 40% превосходит Mercury 2 по уровню «интеллекта» и сопоставима с экономичными моделями GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5.

Inception выпустила диффузионную модель Mercury 2.5_1
Голосовые агенты и интерактивные приложения

По данным Inception, скорость Mercury 2.5 составляет 1 107 токенов в секунду на распространённых GPU NVIDIA. Модель поддерживает контекст объёмом 260 тысяч токенов. Среди заявленных возможностей есть настраиваемый режим рассуждений, параллельные вызовы инструментов и генерация JSON по заданной схеме.

Inception выпустила диффузионную модель Mercury 2.5_3
Генерация веб-приложения моделью Mercury 2.5

Базовая цена составляет $0,20 за миллион входных и $0,75 за миллион выходных токенов. На старте Inception предлагает скидку 80%: цена снижена до $0,04 и $0,15 соответственно.

Модель рассчитана прежде всего на разработчиков поисковых и RAG-систем, голосовых агентов и помощников для программирования. В таких продуктах один пользовательский запрос может запускать много обращений к модели, поэтому задержка и стоимость быстро накапливаются.

Mercury 2.5 доступна через Inception API, Baseten и OpenRouter. Для корпоративных клиентов предусмотрены выделенные мощности, автомасштабирование, настройки хранения данных и средства обеспечения соответствия требованиям.

Источники