Рассуждение как отдельный режим
О событииo1 показал, что дополнительное вычисление во время ответа заметно улучшает решение сложных задач.
Это начало перехода от помощника к агенту. Сегодня такие системы требуют контроля человека: они накапливают ошибки, теряют цель на длинных задачах и почти не учатся на собственном опыте.
О событииo1 показал, что дополнительное вычисление во время ответа заметно улучшает решение сложных задач.
О событииAnthropic открыла стандарт, через который модели подключаются к данным и рабочим инструментам.
О событииResponses API и Agents SDK объединили рассуждение, инструменты, оркестрацию и наблюдаемость.
О событииMETR предложила измерять агентов длительностью человеческой задачи, которую они завершают с заданной надёжностью.
О событииGoogle открыла протокол, позволяющий агентам разных поставщиков обмениваться задачами и результатами.
О событииAgentKit оформил агентные приложения как отдельный инженерный слой с версиями, оценками и трассировкой.
О событииAnthropic выпустила модель для длительных задач в коде и интеллектуальной работе, рассчитанных уже не на один ответ, а на многочасовой или многодневный агентный процесс.
Fable 5 важна не новым максимумом в коротком тесте, а сменой единицы работы: модель проектировали для продолжительных процессов с инструментами, файлами и промежуточной проверкой. После первоначального запуска Anthropic временно ограничила модель и затем вернула её в глобальный доступ — полезное напоминание, что рост автономности требует не только способностей, но и устойчивых защитных механизмов.
Источник 1: Anthropic · запускИсточник 2: Anthropic · карточка моделиИсточник 3: Anthropic · повторный запускО событииAnthropic обновила массовую модель для кода, агентных процессов и повседневной интеллектуальной работы.
Sonnet 5 показывает вторую сторону агентного прогресса: длительные процессы должны быть не только возможны на флагмане, но и достаточно быстры и доступны для постоянного использования. Поэтому событие относится к автономности, хотя сама модель остаётся универсальной и не является отдельным «агентом».
Источник 1: Anthropic · анонсИсточник 2: Anthropic · документация моделейО событииChatGPT Work выполняет более продолжительные задачи с файлами, приложениями и готовыми результатами.
О событииЧем длиннее цепочка действий, тем выше шанс накопить ошибку или неверно понять цель.
О событииАгенту нужно сохранять опыт между задачами и улучшаться без полного переобучения модели.
О событииСистема выполняет долгую задачу самостоятельно, но её план, действия и результат можно проверить.
Первоисточники, на которых основано досье: научные публикации, материалы лабораторий и официальные отчёты.