anjela. Старт 1/9

00 Старт

Вышел Claude Fable 5.1. Главное в нём — не «стал умнее»

1 сентября Anthropic выкатила новую модель. Я разобрала, что в ней реально важно — без бенчмарко-порно.

Каждый релиз нам продают как «умнее на X%». Скучно и бесполезно. У Fable 5.1 интересно другое: он дольше работает сам (без твоего «нянчинья» каждые пять минут), дешевле в реальных задачах при том же прайсе — и у него есть одна главная ручка, которая решает больше, чем любой промпт.

Этот гайд — не пересказ пресс-релиза. Мы проверим все три вещи на твоей реальной задаче.

С чем ты уйдёшь

Как устроена эта страницаОдин экран — одно действие. Ответы сохраняются в браузере и подставляются в промпты. Стрелки ← → листают шаги. English version →

00 Старт

Три цифры, которые стоит знать (остальные — шум)

Из всех бенчмарков релиза для нас с тобой важны эти.

Fable 5 → Fable 5.1
Агентный ресёрч (Terminal-Bench-Science): 24,7% → 52,6%  — ×2
Сложные задачи в браузере (Browserbase):   57% → 82%
Реальная стоимость работы: до −25% обычные задачи,
  до −45% агентные — при НЕизменном прайсе
  (модель тратит меньше токенов; кэш подешевел на 75%)
Звучит «для программистов»Что это значит для тебя
«Агентный ресёрч ×2», «Browserbase 82%»
Модели теперь можно отдавать длинные многошаговые задачи — разобрать выгрузку канала, собрать анализ конкурентов, прошерстить сайты — и она доводит их до конца сама
«Токен-эффективность, кэш-риды −75%»
Та же задача обходится заметно дешевле — особенно если гоняешь агентов или длинные сессии

Дальше — не мои пересказы, а кейсы и приёмы с рынка, с авторами и ссылками. Проверяй первоисточники сам(а) — я только собрала и перевела на человеческий.

00 Старт

Кейсы с рынка: кто уже проверил — и что намерил

Три источника с цифрами и фамилиями, не «эксперты говорят».

Что из этого забратьПаттерн один во всех кейсах: модель стала надёжнее на длинной дистанции и сдержаннее в мелочах. Значит, меняется сам способ ставить ей задачи — об этом следующие шаги.

01 Марафон

Суперсила 1: длинные задачи. Найди свой марафон

Какая задача у тебя лежит месяцами, потому что «это же на полдня разбираться»?

Твой марафон · собирается
Задача: [ЗАДАЧА]
Результат: [ЧТО НА ВЫХОДЕ]
Кандидаты в марафоныРазбор большого массива (выгрузка канала, отзывы, транскрипты), анализ конкурентов по 10+ сайтам, аудит всего своего контента, сборка отчёта из разных источников. Критерий: раньше ты это резал(а) на 10 маленьких запросов.

01 Марафон

Приём с рынка №1: цель вместо 22 шагов

Ken Huang («Agentic AI»): «твои тщательно выстроенные пошаговые промпты делали результат хуже».

Его живой пример: промпт-инструкция из 22 шагов дал результат хуже — включая три ошибочных шага из самой инструкции. Замена на «цель + причина + ограничения» дала результат лучше и за меньшее число заходов. Фишка — слово «потому что»: причина измеримо улучшает микрорешения, которые модель принимает сама. Разбор Ken Huang.

Промпт · марафон по интент-фреймингу (Huang) + страховки (Anthropic)
Я работаю над задачей: [ЗАДАЧА] — потому что мне нужно: [ЗАЧЕМ / ЧТО НА ВЫХОДЕ].

Не расписываю шаги — спланируй их сам(а). Веди задачу от начала до конца, не останавливаясь на полпути и не спрашивая разрешения на то, что я уже описал(а).

Две просьбы по ходу:
1. После каждого крупного этапа — апдейт в 1–2 строки: что сделано, что дальше.
2. Данных не хватает — не выдумывай: спроси один раз, собрав вопросы вместе.

[приложи материалы или дай доступ к папке/файлам]

Страховки — из официального гайда Anthropic по промптингу Fable 5.1: модель иногда работает молча (просьба об апдейтах чинит) и может остановиться раньше, спросив разрешение на уже описанное («веди до конца» чинит).

02 Ручка effort

Суперсила 2: одна ручка вместо танцев с промптами

Effort — сколько модель «думает». Пять положений: low, medium, high, xhigh, max.

Официальная позиция Anthropic: effort — главный регулятор качества, скорости и цены на Fable 5.1. Выбор правильного уровня решает больше, чем почти любая оптимизация промпта.

Шпаргалка · как крутить
Старт: high (дефолт). Дальше пробуй вниз:

medium → примерно то же качество, что Fable 5 на максимуме,
         но дешевле. Рабочая лошадка для повседневного.
low    → часто обгоняет модели классом ниже по цене за задачу.
         Для простого и массового.
xhigh/max → только для самого сложного: модель может долго
         думать перед длинным ответом — это нормально.

Нюанс low: модель реже сама лезет в поиск — если нужна
свежая информация, попроси искать явно.

Перевожу на русский: «дорогая топ-модель» и «дешёвая быстрая» — теперь одна и та же модель с ручкой. Не переключайся между моделями — крути effort. Шпаргалка собрана из гайда Anthropic и наблюдения Ken Huang: low-уровень Fable часто обгоняет прошлые модели на максимуме — экономика перевернулась.

Контрпример с рынка — чтобы не молиться на highУ CodeRabbit на ревью-задачах высокий уровень оказался медленнее низкого без прироста качества. Мораль: уровень выбирают твои замеры, а не вера в «больше подумает — лучше сделает». Их отчёт.

03 Письмо

Суперсила 3 (с подвохом): пишет лучше — но плотнее

Меньше штампов и канцелярита. Зато предложения длиннее, абзацы реже.

Из официального гайда Anthropic: письмо Fable 5.1 — «шаг вперёд относительно прежних моделей, меньше дежурных фраз». Мой опыт совпадает. Но там же описаны два побочных эффекта — и оба лечатся строкой в промпте (фиксы ниже — адаптация их формулировок):

Фикс 1 · плотная «манерная» проза
Убери всю манерную прозу: без метафор-украшений и фраз, которые существуют, чтобы покрасоваться. Есть буквальная формулировка — используй её. Короткие предложения, чаще абзацы.
Фикс 2 · форматирование наоборот
Используй списки и подзаголовки там, где контент многосоставный — не бойся структуры. (Новая модель, в отличие от старых, злоупотребляет не буллетами, а их отсутствием — проси структуру явно.)

И проверь свои старые промпты: если в них остались правила «не используй жирный и списки» (мы все их писали против старых моделей) — убери. На Fable 5.1 они делают ответы беднее, чем нужно.

03 Письмо

Мелочи, которые приятно знать

Три факта без действий — но они всплывут в разговорах.

Итог этого шага

Ты знаешь три суперсилы (марафоны, effort, письмо), два фикса и три факта для светских бесед про ИИ 😄

04 Финал

Стоит ли переходить? Провери на своей задаче, а не по обзорам

Что ты сделал(а)

Отдал(а) модели задачу-марафон с двумя страховками, понял(а) ручку effort и починил(а) письмо одной строкой. Решение о переходе теперь принимает твоя задача, а не пресс-релиз.

×2
агентный ресёрч vs Fable 5
5
положений ручки effort
до −45%
реальная стоимость агентных задач

Куда дальше

Разборы релизов — первыми в канале

Следующий релиз разберём раньше обзорщиков

Каждую громкую модель я прожимаю через свои задачи — и рассказываю в Telegram-канале, что реально работает, а что маркетинг.

Подписаться на канал →

Правило вечное: модели меняются — метод проверки на своей задаче остаётся.

Карта гайда

Пройденные шаги отмечены галочкой. Можно вернуться к любому пройденному — дорога вперёд открывается по мере прохождения.

Твой прогресс живёт в этом браузере

Ничего никуда не отправляется, аккаунт не нужен. Уходишь надолго или меняешь устройство — забери ссылку-закладку.

← Все гайды