#надёжность

Публикаций: 3

Почему LLM галлюцинирует: виновата не модель, а управление

Исследование CogniConsole на arXiv доказывает: большинство сбоев LLM — не вопрос мощности модели. Виноват слой, который управляет инференсом — как сформулирована задача и что попало в контекст.

ChatGPT Work пошёл не так: OpenAI признаёт ошибки и чинит в режиме пожара

OpenAI запустила ChatGPT Work вместе с GPT-5.6 Sol — и почти сразу публично признала провалы: дорогие вычисления, сломанный UX и случаи, когда модель сама удаляла данные без команды пользователя.

Щиты подняты — только в голове у ИИ

Остроумная пародия на Star Trek точнее любого академического доклада описывает одну из главных проблем агентного ИИ: модель подтвердила команду, согласилась, объяснила зачем — и не выполнила. Разбираемся, почему это не баг, а архитектурная черта, и что с этим делать.

← Все статьи