Борис Черный (создатель Claude Code в Anthropic) дал свежее интервью YC. Главный фокус — недавний релиз Opus 5 и то, как фундаментально меняется наш подход к работе с моделями. Спойлер: мы всё усложняем.
Выделил главное из беседы:
1. Прорыв в логике и ARC-AGI-3
Opus 5 набрал 30% в бенчмарке ARC-AGI-3. Если вы сами пробовали проходить эти визуально-логические головоломки (я как раз недавно тестировал на них свои силы, это ломает мозг — подробно писал об этом здесь), то понимаете, что для ИИ это огромный скачок. Раньше лучшие результаты едва переваливали за 10-15%.
2. Тотальная автономия
Модель теперь может автономно выполнять задачу не минуты, а дни и даже месяцы. Борис привел пример: он поручил агенту переписать десктопное приложение с Electron на Swift, запускать его на виртуалке Mac, делать скриншоты и попиксельно сравнивать результат. Процесс идет уже больше двух недель, агент сам пишет отчеты о прогрессе в Slack.
3. Prompt injection почти решена
Opus 5 практически неуязвим для джейлбрейков. Благодаря механистической интерпретируемости (в Anthropic буквально смотрят на нейроны, которые загораются при попытке взлома) и новым классификаторам заставить модель выполнить вредоносную инструкцию из сети стало почти невозможно.
4. Эффект product overhang
Разработчики удалили 80% системного промпта из Claude Code. Оказалось, что чем умнее модель, тем больше ей мешают наши жесткие инструкции и «костыли». Модели уже могут гораздо больше, чем мы от них просим, но наши интерфейсы и привычки их ограничивают (unhobbling).
Что это значит для промптинга
- **Забудьте про жесткие инструкции.** Хватит писать промпты в духе «сделай шаг 1, потом шаг 2». Давайте модели задачу на уровень сложнее, чем обычно, определяйте рамки, критерии готовности и — самое важное — давайте ей инструменты для самостоятельной проверки результата. Дальше пусть думает сама.
- **Обнуляйтесь с каждым новым релизом.** Выбрасывайте свои старые кастомные инструкции и заготовленные полотна промптов. То, что было необходимо для Opus 4 или Sonnet 3.5, сейчас только сбивает модель с толку.
- **Относитесь к промптингу как к эмпирической науке.** Забудьте про «магические слова» и микроменеджмент. Поставили задачу → дали инструменты верификации → посмотрели, где модель споткнулась → точечно добавили контекст.
Общайтесь с ней скорее как с компетентным коллегой, а не как со скриптом.
Посмотреть полное видео можно здесь.