На AI Engineer World's Fair Саймон Уиллисон провёл разговор с Кэт Ву и Тариком Шихипаром из команды Claude Code в Anthropic. Не маркетинговое интервью — живая беседа о том, как устроена инженерия внутри компании: сколько людей реально смотрит на каждую строчку кода, как меняется eval-процесс при смене модели, и что происходит, когда больше половины PR мёржит ИИ без человека.
Контекст
Claude Code вышел в феврале 2025-го — изначально просто как пункт в анонсе Sonnet 3.7. За полтора года он прошёл путь от «нужно читать каждый permission prompt» до режима, где инженеры делегируют целые фичи одной командой и не смотрят на промежуточные шаги. Параллельно Anthropic выпустила Claude Tag — Slack-интеграцию, которая работает как автономный участник команды: мониторит каналы, создаёт PR, тегирует ответственных, запоминает предпочтения всего канала на будущее.
Новая модель Fable (Claude 5) проходит красной нитью через весь разговор. По словам команды, с ней впервые стало реальным one-shot — написать сложную фичу одним запросом. Тарик использовал Fable для монтажа launch-видео самого Fable. Это не метафора.
Внутри Anthropic dogfooding называют «ant fooding». Команда не просто пользуется своими инструментами — они принципиально не ищут обходные пути, когда продукт не справляется. Если что-то сломано — чинят продукт, а не меняют workflow.
Аналитика
65% инженерных PR продуктовой команды Claude Code проходят через Claude Tag — то есть без человека-ревьюера. Это не случилось за ночь. Шесть месяцев итеративного расширения зоны доверия: брали файлы, где автоматика ловила 100% проблем, исключали из ручного ревью, добавляли следующие. Когда происходил инцидент — тот PR попадал в eval-сет, чтобы такое не повторялось. Инфраструктура доверия строится через провалы, а не через уверенность.
Второй крупный сдвиг: системный промпт Claude Code уменьшился на 80%. Причина — для Fable 5 и Opus 4.8 примеры в промпте и длинные списки «не делай X» снижают качество. Всё, что было лучшей практикой год назад, теперь работает против вас. Это радикально меняет подход к prompt engineering в продакшне: меньше инструкций, больше контекста и цели.
Тарик прямо говорит: он теперь за рерайты. «Мифический человеко-месяц» с заповедью «никогда не переписывай» устарел. Логика простая: кодовая база — это единственная копия спеки, которая реально существует. Её можно взять как артефакт и дистиллировать. Команда переписала внутренний runtime Claude Code с Bun на Rust — и зашипала в продакшн в июне 2026-го.
Кейсы применения в бизнесе
B2B-SaaS стартап (10–30 разработчиков): настройте Claude Tag в Slack-каналах поддержки и QA. Дайте инструкцию: мониторить баг-репорты, создавать PR с фиксом, тегировать last-toucher. Баги из саппорта начнут появляться в беклоге уже с черновиком PR. Разработчики занимаются архитектурой, а не рутиной.
Корпорация с legacy-кодом: используйте подход «кодовая база как спека». Запустите Claude Code на легаси-модуль с задачей: сначала написать тест-сьют по существующему поведению, затем переписать модуль. Тест-сьют — страховка, переписывание — скорость. По оценкам команды, рерайт с нормальными тестами быстрее и надёжнее инкрементального рефакторинга без них.
SMB / локальный бизнес в КР/СНГ (1–5 человек, нет выделенного инженера): нетехнический маркетолог может описать фичу в Slack, Claude Tag сгенерирует черновик кода и запишет демо. Именно так маркетинговая команда Anthropic изучает новые возможности продукта — Клод клонирует репозиторий, разбирается сам и показывает демо в записи.
Кейсы в личной жизни
Разработчик: попробуйте сценарий «ноутбук + remote control». Вечером открываете несколько сессий Claude Code, подключаете ноутбук к зарядке, блокируете экран — и управляете с телефона с дивана. Кэт говорит, что сама не понимала смысла этой фичи, пока не увидела, как она стала массовым паттерном внутри Anthropic. Реальный workflow, не фича для демо.
Контент-мейкер / видеодел: Fable умеет редактировать видео с конкретными брендовыми требованиями. Тарик использовал это для монтажа в условиях жёсткого дедлайна. Попробуйте дать сырой материал с описанием стиля и ограничений. По его словам, то, что раньше занимало день — теперь в часах.
Студент / джуниор: уберите из запросов все «не делай X» — для современных моделей это снижает качество ответа. Пробуйте one-shot для задач, которые кажутся большими. По словам команды, доля задач, где это работает, резко выросла с Fable.
Как применить сегодня
- Уберите из системных промптов все примеры и списки запретов — для Fable 5 и Opus 4.8 они работают против вас. Оставьте контекст и цель.
- Добавьте Claude Tag в баг-трекер-канал Slack, дайте инструкцию мониторить и создавать PR. Через неделю проверьте, сколько фиксов прошли без вас.
- Перед следующим рефакторингом — попросите Claude написать тест-сьют по текущему поведению, затем переписывайте. Рерайт с тестами быстрее инкрементального рефакторинга без них.
- Переносите код-ревью на Claude поэтапно: начните с модулей, где автоматика уже ловит 100% проблем. Расширяйте зоны доверия медленно, ведите eval-сет по инцидентам.
- Попробуйте remote control: запустите длинную задачу, заблокируйте экран ноутбука, управляйте с телефона. Это реальный паттерн продуктивной работы, не эксперимент.