2026-07-14 02:28 · 🤖 AI World
Группа исследователей опубликовала на arXiv строгий математический фреймворк для верификации adversarial robustness многослойных перцептронов. Впервые вводится «complete certification» — понятие, которого в литературе раньше не было: минимальная зона, за пределами которой предсказание сети гарантированно меняется.
2026-07-14 02:18 · 🤖 AI World
Группа исследователей опубликовала на arXiv теоретический фреймворк, впервые формализующий оба направления сертификации устойчивости MLP-нейросетей. Главный сюрприз: два типа гарантий оказались асимметрично сложными с точки зрения вычислений.
2026-05-23 22:03 · 🤖 AI World
Nous Research выяснила, какие именно нейроны отвечают за отказы instruct-моделей — и научилась их адресно отключать без дообучения и без изменения весов. Всего 0,1% MLP-активаций держат под контролем весь refusal-механизм.