Описание на големи езикови модели

Семейство

Зареждане…

Име на модел

Тип лиценз

Зареждане…

Достъп

Достъп чрез чат интерфейс

Достъп чрез API

Достъп за изтегляне

Модалност на входящите данни

Модалност на изходящите данни

Размер (параметри)

Година на публикуване

Включва български

Форма за обратна връзка

Qwen 3
Qwen8B
×
Типове достъп
Чат: Безплатен
API: Платен
Изтегляне: Безплатен
Семейство
Qwen
Създател
Alibaba Cloud
Тип лиценз
Apache 2.0
Дата на публикуване
28.04.2025
Модалност
Текст към текст (езиков модел с хибридно мислене)
Модалност на входящите данни
Модалност на изходящите данни
Размер в брой параметри
8B
Архитектура на модела
Хибридна архитектура, поддържаща режим ‘Thinking’ и ‘Non-Thinking’, подобрена трансформационна структура
Дължина на контекста
128K токена (освен 0.6B, 1.7B, 4B модели)
Включва ли се български
Неизвестно
Заложени езици
119 езика
Кратко описание на предназначението на модела
Програмиране, математика, агентски способности, инструментална употреба, поддръжка на протокол за контекста на модела
Кратко описание на данните за трениране
36 трилиона токена на 119 езика, включва и синтетични данни
Кратко описание на начина на трениране
Информация за данните за тестване
CodeForces Elo, AIME, BFCL, LiveCodeBench, ArenaHard, общи способности
Допълнителни методи или особености на модела
Хибридно мислене, превключване между /think и /no_think токени
Връзки към публикации, описващи модела
Официален блог: https://qwenlm.github.io/blog/qwen3/