Inception выпустила диффузионную модель Mercury 2.5
По данным Inception, Mercury 2.5 выдаёт 1 107 токенов в секунду и поддерживает контекст на 260 тысяч токенов. Модель доступна через Inception API, Baseten и OpenRouter.

8 сентября 2026 года Inception выпустила Mercury 2.5, быструю и недорогую языковую модель для поиска, RAG-систем, голосовых агентов и других задач с множеством вызовов. По оценке разработчика, новая версия на 40% превосходит Mercury 2 по уровню «интеллекта» и сопоставима с экономичными моделями GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5.
По данным Inception, скорость Mercury 2.5 составляет 1 107 токенов в секунду на распространённых GPU NVIDIA. Модель поддерживает контекст объёмом 260 тысяч токенов. Среди заявленных возможностей есть настраиваемый режим рассуждений, параллельные вызовы инструментов и генерация JSON по заданной схеме.
Базовая цена составляет $0,20 за миллион входных и $0,75 за миллион выходных токенов. На старте Inception предлагает скидку 80%: цена снижена до $0,04 и $0,15 соответственно.
Модель рассчитана прежде всего на разработчиков поисковых и RAG-систем, голосовых агентов и помощников для программирования. В таких продуктах один пользовательский запрос может запускать много обращений к модели, поэтому задержка и стоимость быстро накапливаются.
Mercury 2.5 доступна через Inception API, Baseten и OpenRouter. Для корпоративных клиентов предусмотрены выделенные мощности, автомасштабирование, настройки хранения данных и средства обеспечения соответствия требованиям.














