Борис Черный о промптинге с Opus 5 в Claude Code

Борис Черный рассказал, что Opus 5 набрал 30% на ARC-AGI-3, агенты теперь работают автономно неделями, а разработчики Claude Code удалили 80% системного промпта.

Автор: Michael Kokin ·

Борис Черный (создатель Claude Code в Anthropic) дал свежее интервью YC. Главный фокус — недавний релиз Opus 5 и то, как фундаментально меняется наш подход к работе с моделями. Спойлер: мы всё усложняем.

Выделил главное из беседы:

1. Прорыв в логике и ARC-AGI-3
Opus 5 набрал 30% в бенчмарке ARC-AGI-3. Если вы сами пробовали проходить эти визуально-логические головоломки (я как раз недавно тестировал на них свои силы, это ломает мозг — подробно писал об этом здесь), то понимаете, что для ИИ это огромный скачок. Раньше лучшие результаты едва переваливали за 10-15%.

2. Тотальная автономия
Модель теперь может автономно выполнять задачу не минуты, а дни и даже месяцы. Борис привел пример: он поручил агенту переписать десктопное приложение с Electron на Swift, запускать его на виртуалке Mac, делать скриншоты и попиксельно сравнивать результат. Процесс идет уже больше двух недель, агент сам пишет отчеты о прогрессе в Slack.

3. Prompt injection почти решена
Opus 5 практически неуязвим для джейлбрейков. Благодаря механистической интерпретируемости (в Anthropic буквально смотрят на нейроны, которые загораются при попытке взлома) и новым классификаторам заставить модель выполнить вредоносную инструкцию из сети стало почти невозможно.

4. Эффект product overhang
Разработчики удалили 80% системного промпта из Claude Code. Оказалось, что чем умнее модель, тем больше ей мешают наши жесткие инструкции и «костыли». Модели уже могут гораздо больше, чем мы от них просим, но наши интерфейсы и привычки их ограничивают (unhobbling).

Что это значит для промптинга

Общайтесь с ней скорее как с компетентным коллегой, а не как со скриптом.

Посмотреть полное видео можно здесь.

!video