Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта
Американский стартап Reflection AI намерен составить конкуренцию китайским разработчикам открытых моделей ИИ. В понедельник, 5 октября, компания представила свою первую модель Beam. Reflection AI была основана в 2024 году бывшими исследователями из Google DeepMind. Согласно собственным тестам производительности, Beam способна конкурировать с китайской моделью GLM-5.2 от компании Z.ai.
В сегменте так называемых моделей с открытыми весами (open-weight models) китайские ИИ-компании на данный момент считаются лидерами. Одним из наиболее известных примеров является DeepSeek. В отличие от закрытых моделей (например, от OpenAI или Anthropic), такие модели обходятся значительно дешевле, так как лицензионные отчисления обычно отсутствуют или минимальны. Кроме того, компании и научно-исследовательские учреждения могут самостоятельно развертывать их локально и адаптировать под свои нужды.
В Beam используется архитектура, известная как Mixture-of-Experts. При такой схеме для обработки каждого токена активируются лишь отдельные подсети. Это снижает вычислительные затраты по сравнению с моделями аналогичного размера, использующими все параметры целиком. Общее количество параметров в модели Beam составляет 501 миллиард; при обработке одного токена задействуются 23 миллиарда из них. Модель GLM-5.2 от Z.ai насчитывает около 744 миллиардов параметров, из которых 40 миллиардов являются активными для каждого токена.
Впрочем, компания Z.ai представила преемницу этой модели — GLM-5.3 — еще в августе. В ряде тестов, опубликованных компанией Reflection, эта модель превосходит Beam. Модель от Reflection AI еще не была выпущена в широкий доступ; пока она доступна лишь ограниченному кругу пользователей. Фактические эксплуатационные расходы для пользователей пока неизвестны.
С помощью Beam компания Reflection стремится показать, что мощные открытые модели ИИ могут создаваться и в США. С одной стороны, речь идет о глобальной гонке между Китаем и США. С другой — единого мнения нет и среди западных ИИ-компаний: в то время как такие фирмы, как Anthropic и OpenAI, часто заявляют, что модели с открытыми весами более уязвимы для злоупотреблений и взлома защиты (джейлбрейка), другие американские технологические компании, например Microsoft и Nvidia, поддерживают подход, основанный на открытых весах.