Ртуть 2.5

#Ртуть #Статья #Introducing-mercury #Пункты #Комментарии

Статья URL: https://www.inceptionlabs.ai/blog/Introducing-mercury-2-5Requessions: http s://news.ycombinator.com/item?id=49616354 Пункты: 12 # Комментарии: 0

Сегодня мы выпускаем Mercury 2.5, нашу наиболее способную модель производства. Это значительный шаг вперед в повышении качества по сравнению с Меркурием 2, при том же низком уровне жесткости и низкой стоимости обслуживания. С момента запуска Mercury286s тысячи разработчиков построили с ней, десятки предприятий ввели ее в производство и использование возросло на порядок. В настоящее время она обслуживает с учетом требований латентности всю работу по поиску, голосовому и кодированию продуктов. Эта рабочая нагрузка дает нам более четкий сигнал, чем одни лишь контрольные показатели. Мы использовали отзывы клиентов и случаи неудач в производстве, чтобы совершенствовать эвалеты и фокусировать подготовку. Ртуть 2.5 является первым результатом этой петли. Изменение Mercury 2.5 является наиболее эффективным способом распространения LLM на рынке. Насколько нам известно, это крупнейшая из когда-либо подготовленных диффузионных языковых моделей. Сопоставимы с такими высокозатратными моделями, как GPT-5.6 Luna (Low), Bemini 3.5 Flash-Lite и Клод Хайку 4.5. Скорость: 1 107 символов в секунду на широко доступных ГПСН NVIDIA. Контекст: 260K Символы. - Цена: 0,20 долл. США за миллион затрат и 0,75 долл. на миллион выпуска. - На запуске Mercy 2.5 находится 80% от 0,04 долл. за миллион вводных ресурсов и 0,15 долл С момента запуска Mercury 2 мы смотрели усовершенствованные языковые модели на основе инъекций, основанные на диффузии инфраструктуры NVIDIA AI. Повышение интеллекта ртути 2.5 в…