#MLP

Публикаций: 3

Нейросеть под сертификатом: как доказать надёжность MLP математически

Группа исследователей опубликовала на arXiv строгий математический фреймворк для верификации adversarial robustness многослойных перцептронов. Впервые вводится «complete certification» — понятие, которого в литературе раньше не было: минимальная зона, за пределами которой предсказание сети гарантированно меняется.

Доказано математически: где нейросеть гарантированно не изменит ответ

Группа исследователей опубликовала на arXiv теоретический фреймворк, впервые формализующий оба направления сертификации устойчивости MLP-нейросетей. Главный сюрприз: два типа гарантий оказались асимметрично сложными с точки зрения вычислений.

0,1% нейронов LLM управляют всеми отказами — находка Nous Research

Nous Research выяснила, какие именно нейроны отвечают за отказы instruct-моделей — и научилась их адресно отключать без дообучения и без изменения весов. Всего 0,1% MLP-активаций держат под контролем весь refusal-механизм.

← Все статьи