Команда разработчиков Alibaba Qwen официально представила новую каузальную языковую модель Qwen3.8-2.4T-A95B, открыв доступ к её весам через сообщество ModelScope. Данный релиз является значимым событием для индустрии, так как это первая открытая модель в линейке Qwen, сопоставимая по своим возможностям с флагманской версией Qwen-Max. Публикация исходного кода позволяет разработчикам по всему миру заниматься воспроизведением, тонкой настройкой и созданием вторичных программных продуктов на базе технологий Alibaba.
Архитектура MoE и технические характеристики
Модель базируется на разреженной архитектуре Mixture of Experts (MoE), которая позволяет эффективно распределять вычислительные ресурсы. Общий объем параметров системы составляет 2,4 триллиона (2.4T), при этом для обработки каждого отдельного токена активируется лишь 95 миллиардов (95B) параметров. Такой подход обеспечивает высокую производительность при сохранении относительной экономичности вычислений.
- Контекстное окно: стандартная поддержка 262 144 токенов с потенциалом расширения до 1 010 000 токенов.
- Метод обучения: многоэтапное обучение с использованием технологии Multi-Token Prediction.
- Применение: на базе этой модели построена официальная облачная версия Qwen3.8-Max, предназначенная для работы в высоконагруженных производственных средах.
Возможности для разработчиков и бизнеса
Открытие весов модели такого уровня предоставляет сообществу Open Source беспрецедентные инструменты для создания сложных ИИ-решений. Благодаря поддержке сверхдлинного контекста — более одного миллиона токенов — Qwen3.8-2.4T-A95B способна обрабатывать массивные документы и сложные программные коды без потери логической связности. Это делает её востребованной в корпоративном секторе, где требуется глубокий анализ данных.
Открытый исходный код позволит разработчикам воспроизводить, донастраивать и вторично разрабатывать модели на её основе, способствуя развитию глобальной экосистемы искусственного интеллекта.
Выпуск Qwen3.8-2.4T-A95B укрепляет позиции Alibaba Cloud как одного из лидеров в области генеративного ИИ. Предоставление доступа к технологиям уровня Qwen-Max может существенно ускорить интеграцию нейросетевых решений в коммерческие продукты, предлагая альтернативу закрытым проприетарным моделям от других технологических гигантов. В ближайшее время ожидается появление множества специализированных надстроек на базе Qwen3.8, адаптированных под конкретные отраслевые задачи.