Arcee представила Trinity-Large-Thinking — текстовую модель с 399 миллиардами параметров

Лаборатория Arcee, расположенная в Сан-Франциско, представила Trinity-Large-Thinking — текстовую модель reasoning, обладающую 399 миллиардами параметров. Модель доступна под лицензией Apache 2.0, что позволяет как независимым разработчикам, так и крупным компаниям свободно её использовать и модифицировать. Trinity-Large-Thinking нацелена на предоставление альтернативы закрытым моделям, которые преобладают на рынке, особенно в условиях растущей обеспокоенности по поводу китайских архитектур в критической инфраструктуре.

Команда Arcee из 30 человек применяет уникальный подход «инженерия через ограничения» и инвестировала $20 миллионов в обучение модели с использованием кластера из 2048 GPU NVIDIA B300 Blackwell. Архитектура Mixture-of-Experts активирует лишь 1,56% параметров для каждого токена, что обеспечивает высокую эффективность. Модель прошла обучение на 20 триллионах токенов, включая синтетические данные, что улучшило её понимание концепций.

Основное обновление — фаза «мышления» перед генерацией ответа, что повысило стабильность и результативность в сложных задачах. В тестах PinchBench модель показала результат 91.9, близкий к лидеру Claude Opus 4.6. Arcee также выпустила Trinity-Large-TrueBase с 10 триллионами токенов для полной адаптации. Trinity-Large-Thinking уже зарекомендовала себя положительно, став самой популярной моделью на платформе OpenRouter в США, обрабатывая более 80 миллиардов токенов в день, при цене $0.90 за миллион токенов, что значительно дешевле аналогов.