#GPT

Публикаций: 5

Читерят ли AI-лабы с бенчмарками: тест на пеликане

Исследователь Дилан Кастильо провёл масштабный эксперимент, чтобы выяснить, не натренированы ли топовые AI-модели специально рисовать пеликана на велосипеде лучше всего остального. Вопрос кажется абсурдным — до тех пор, пока не понимаешь, что стоит за ним.

OpenAI: хватит формулировать промпты — просто опишите результат

OpenAI выпустил гайд по промптингу для обычных пользователей — без жёстких формул и инженерных ритуалов. Четыре необязательных блока и один принцип: говори, что хочешь получить, а не как это сделать.

GPT-5.6 Sol: пять уровней мышления и когда включать каждый

GPT-5.6 Sol вышел с пятью уровнями «глубины рассуждений» — от лёгкого Light до тяжёлого xhigh — плюс режимы Max и Ultra с параллельными суб-агентами. Сотрудник OpenAI Вайбхав Сриваставе дал простое правило: стартуй снизу и повышай уровень только по необходимости.

Sol против Fable 5: один балл разницы, тройной разрыв в цене

GPT-5.6 Sol набирает 59 баллов на Artificial Analysis Intelligence Index — на один балл меньше флагмана Anthropic Fable 5 — и стоит в три раза дешевле. В агентном программировании Sol обходит всех конкурентов, превращая разницу в один балл в серьёзный аргумент для пересмотра выбора модели.

Почему ИИ не может посчитать буквы: токенизация изнутри

LLM видит ваш текст не как буквы и слова, а как токены — и именно это объясняет, почему модель путается в простой арифметике, коверкает слова при перевороте и иногда ведёт себя как сломанный автомат. Разбираем механику изнутри.

← Все статьи