Неискусственный интеллект

@anti_agi
Фото Лучшая компактная, народная китайская Qwen выложила веса Qwen3.8-27B под Apache 2.0. Денс модель на 27,8 млрд параметров, нативно мультимодальная, картинки и видео. 64 слоя по схеме три блока Gated DeltaNet на один блок полного внимания, то есть линейное внимание в 48 слоях из 64. Контекст 262 144 токена нативно, до 1 млн через YaRN. Словарь 248 320 токенов, MTP, три уровня reasoning_effort с xhigh по умолчанию. Есть сразу FP8-версия. Бенчмарки заявлены самой Qwen, почти все агентные прогонялись через Claude Code: ▪️ SWE-bench Pro: 61,7 против 53,4 у Opus 4.6 Max и 51,2 у Muse Glimmer-30B ▪️ OSWorld-Verified: 84,3 против 72,7 и 65,9 ▪️ Terminal Bench 2.1: 73,0 против 78,2 и 51,7 ▪️ AndroidWorld: 81,9 против 62,0 у Opus 4.6 Max ▪️ LiveCodeBench v6: 90,3 против 88,8 у Opus 4.6 Max ▪️ GPQA Diamond: 89,2 против 91,3 и 83,5 ▪️ HLE: 30,8 против 40,0 и 22,0 @anti_agi
Если у вас установлено приложение,
вы можете сразу перейти в канал