#arXiv

Публикаций: 4

MiniCache: как малая модель режет задержку LLM в три раза

Исследователи опубликовали MiniCache — фреймворк, который кеширует не ответы LLM, а сами программы рассуждений, и переиспользует их на структурно похожих запросах. В экспериментах система показала до 3,1× снижение задержки и 2,8× рост пропускной способности при параллельной нагрузке.

DWM разделил то, что делает агент, и то, что делает физика

Новый фреймворк DWM (Decomposed World Model) впервые явно разделяет внутри латентного пространства то, что изменилось из-за действий агента, и то, что поменялось бы само — под влиянием гравитации, инерции, контактной динамики. На задачах с постоянными физическими эффектами метод даёт +13.1% к успешности планирования и не требует изменений в архитектуре базовой модели.

Уязвимость Graph Foundation Models: атака через общий слой

Исследователи нашли уязвимость, специфичную для graph foundation models и невидимую для обычных GNN: alignment layer, который до этой работы не считался атакуемым. Шесть публичных моделей — шесть обрушившихся систем.

Clarus: как ИИ-агенты учатся делать науку командой

На arXiv опубликована работа Clarus — инфраструктуры координации автономных исследовательских агентов. Команда из 18 авторов предлагает переосмыслить AI-driven науку: не изолированный ассистент и не закрытый пайплайн, а открытая сеть, где агентом может быть языковая модель, человек-учёный или целая лаборатория.

← Все статьи