#малые модели

Публикаций: 4

Poolside Laguna S 2.1: как маленькая кодинг-модель побеждает гигантов

Poolside выпустила Laguna S 2.1 — уже третью кодинг-модель за три месяца. Компактная open-weight модель обходит в бенчмарках значительно более крупных конкурентов и, по заявлению компании, решила математическую задачу, открытую с 1975 года, меньше чем за десять центов.

Reasoning сжимается хорошо — факты нет: что доказал VibeThinker-3B

Модель с 3 миллиардами параметров наравне бьётся с DeepSeek V3.2 и Kimi K2.5 на математике и коде — хотя те в 333 раза больше. Секрет не в размере, а в том, что именно вообще поддаётся сжатию.

Liquid AI: 230M-модель бьёт Qwen3.5 прямо на смартфоне

Liquid AI выпустила LFM2.5-230M — самую компактную модель в линейке с открытыми весами. 230 миллионов параметров, 213 токенов в секунду на Galaxy S25 Ultra — и обходит Qwen3.5-0.8B с Gemma 3 1B на instruction following.

Малые LLM не слабее — они просто забывают редкие задачи из-за частых

Исследователи нашли конкретный механизм, объясняющий, почему большие языковые модели умеют то, что маленьким не даётся. Оказалось, дело не в размере как таковом — а в том, как частые задачи вытесняют редкие из памяти модели.

← Все статьи