Уровень усилия
Effort — уровень усилия, параметр, который задаёт, сколько модель думает перед ответом. Это главный рычаг между качеством, скоростью и ценой: начните с high, он стоит по умолчанию, и проверьте low, medium, xhigh и max на своих тестах, потому что одно название уровня у разных моделей означает разный объём размышлений.
По замерам Anthropic, на medium Fable 5.1 примерно равна Fable 5, но дешевле, а на low часто сравнима с Claude Opus и Claude Sonnet по цене задачи и отвечает точнее, так что там, где тесты не показывают потери качества, стоит спускаться ниже.
На low модель реже обращается к поиску и чаще отвечает по памяти: помогает поднять усилие на отдельные ходы или строка в системном запросе о том, что знакомое название ещё не значит знание его нынешнего состояния. На xhigh и max модель может набросать длинный текст в размышлении, а потом написать его ещё раз в ответе; такие задачи лучше запускать на high, а иначе задать max_tokens, предел длины ответа, с запасом на размышление и предупредить, что весь ход укладывается в один лимит.
Отчёты по ходу работы
Во время длинных цепочек инструментов Fable 5.1 пишет пользователю меньше, чем Fable 5: агент молчит минутами, а в конце описывает только последний шаг.
Сначала проверьте, доходят ли отчёты: заметки между вызовами инструментов приходят как блоки размышления, по умолчанию пустые, их показ надо включить (пока бета). Затем уберите из системного запроса запреты на промежуточные отчёты, написанные против болтливых старых моделей. Только после этого просите модель коротко отчитываться по ходу и заканчивать итогом, понятным без остальной переписки.
Текст и оформление
Fable 5.1 пишет почти без штампов и жаргона, но местами плотнее Fable 5: длиннее предложения, реже абзацы. Помогает инструкция, которая описывает манерную прозу (метафоры вместо прямого высказывания) и просит говорить буквально.
С оформлением наоборот: Fable 5.1 сама реже берётся за заголовки, списки и жирный, поэтому запреты на них, написанные для прежних моделей, теперь вредят; замените их правилом, когда список уместен, а когда нужна проза.
При пересказе документов модель чаще Fable 5 воспроизводит куски источника, не помечая их как цитату. Лечится одним полным примером в системном запросе: просьба пользователя, правильный ответ, где чужой текст изложен своими словами, и фраза, почему он верный.
Довести до конца, но не делать лишнего
На сложной самостоятельной работе модель иногда завершает ход раньше времени: описывает следующий шаг вместо того, чтобы сделать его, или спрашивает разрешения на уже порученное. Anthropic предлагает два добавления к системному запросу. Первое объясняет, что пользователь не следит в реальном времени, поэтому обратимые действия надо выполнять без вопросов, а если последний абзац ответа оказался планом или обещанием, сделать это сейчас. Второе определяет объём работы: запрос пользователя и есть результат, его нельзя молча сужать или расширять, а попутные улучшения надо предлагать, а не делать.
Обратная крайность: при открытых задачах модель иногда чинит соседний код и оставляет лишние тестовые файлы. По замерам Anthropic, просьба не трогать то, чего задача не касается, и добавлять тесты только там, где просят, заметно сокращает лишние правки без потери в решении задач. Ещё Fable 5.1 чаще переписывает файл целиком ради мелкой правки; просьба править точечно возвращает поведение Fable 5.
История разговора
Каждый ход модели добавляйте в историю в том виде, в каком его вернул API, вместе с блоками размышления, и не правьте прежние ходы между запросами. Для аккаунтов, созданных с 31 августа 2026 года, блоки размышления действительны только в разговоре, где появились: если системный запрос, список инструментов или любое прежнее сообщение изменились, API вернёт ошибку.
Те же правки сбрасывают и кэш запроса: напоминания, вставленные в старые ходы, сжатие истории на месте, смена системного запроса посреди сессии. Напоминания шлите системным сообщением на один ход, которое API сам убирает после следующего сообщения пользователя (бета); инструкции и инструменты меняйте сообщением посреди разговора; сжатие доверьте серверу. Если сжимаете сами, замените всю историю одним итогом и новым ходом пользователя и перечислите модели, что итог обязан сохранить. Чтение из кэша подешевело, и раннее сжатие ради экономии может быть уже невыгодно.
Тем же сообщением на один ход стоит просить модель объединять независимые вызовы инструментов: в цепочках кода она иногда делает по одному за ход, а каждый лишний ход стоит токенов и времени.
Отказы по ошибке
Защитные фильтры Fable 5.1 срабатывают впустую реже, чем у Fable 5 на старте, а искать уязвимости в коде разрешено. Ложные отказы всё же бывают: ответ приходит с причиной остановки refusal. Где они вероятнее:
- вопрос, скомпилируется ли программа без ошибок: спросите, есть ли в ней ошибки;
- малоизвестный язык программирования: дайте модели его документацию;
- данные в base64 в выводе инструментов: их лучше убрать.
Помощники и картинки
Если агент умеет поручать работу вспомогательным агентам, не заставляйте главного ждать каждого: по замерам Anthropic, на задачах с кодом это сокращает среднее время до результата при том же качестве и расходе. Для этого запуск помощника должен возвращать управление сразу, результат приходить позже отдельным сообщением, а ожидание быть отдельным инструментом. Модель всё равно часто ждёт: выигрыш дают запуски, где она продолжает работать.
На плотных схемах и графиках модель точнее, когда может резать и увеличивать картинку: дайте ей контейнер с изображениями и библиотеками обработки или хотя бы инструмент, возвращающий выбранный участок увеличенным; он даёт большую часть выигрыша.