Возможности ИИ
Чтение: 4 минуты
Насколько автономными уже стали ИИ-агенты?
Материал подготовлен AI Futures. Редакционная ответственность и решение о публикации — MMX.
ИИ-агенты уже могут самостоятельно выполнить цепочку понятных цифровых действий. Но они ещё не стали универсальными сотрудниками, которым можно без контроля поручить любую цель.
Актуальность материала
Проверены актуальная методика METR, новая независимая оценка и данные Anthropic. Возможности растут, но длинные временные горизонты остаются неопределёнными и не равны непрерывной работе без человека.
История обновлений
- — Проверены актуальные оценки автономности и ограничения методики; основной вывод без изменений.
- — Материал опубликован после evidence и reader-comprehension прохода.
«Проверено» означает, что мы пересмотрели актуальность источников и вывода. Это не означает, что прогноз гарантированно сбудется.
Главное за минуту
Что показывают данные
- В лабораторных тестах сильнейшие публичные системы начала 2026 года выполняли с вероятностью 50% задачи, на которые человеку-эксперту требовалось около 12 часов.
- Для более надёжного результата — 80% успеха — оценка составляла лишь около 1,5 часа человеческой работы.
- В реальных продуктах большинство самостоятельных действий намного короче: медиана одного хода агента Claude Code была около 45 секунд.
- Чем больше свободы получает агент, тем важнее ограничения доступа, журнал действий и возможность остановить его.
Что здесь называется ИИ-агентом
Обычный чат-бот отвечает на вопрос. ИИ-агент получает цель, разбивает её на шаги, пользуется программами или файлами, проверяет промежуточный результат и продолжает работу. Например, он может найти ошибку в коде, изменить несколько файлов и запустить тесты.
Автономность не означает, что система работает без правил. Важно не только, насколько долго она действует, но и что ей разрешено: читать документы, менять код, выходить в интернет или подтверждать опасные операции.
Что означает «12 часов автономности»
METR измеряет «временной горизонт»: сколько времени такая задача заняла бы у человека-эксперта. Это не длительность непрерывной работы агента. По данным отчёта за февраль—март 2026 года, сильнейшие публичные системы достигали примерно 12 часов при 50% успеха.
Но оценкам выше 16 часов сами исследователи пока не доверяют: длинных заданий недостаточно. Кроме того, тесты в основном относятся к программированию, машинному обучению и кибербезопасности. Задачи заранее сформулированы, изолированы и допускают сравнительно ясную проверку.
Факт
Агенты справляются со всё более сложными, но хорошо определёнными цифровыми задачами.
Интерпретация AI Futures
Рост временного горизонта — важный сигнал прогресса, но не доказательство появления универсального цифрового сотрудника.
В реальной работе автономные эпизоды обычно короче
Anthropic изучила миллионы взаимодействий с Claude Code и API. Медианный ход агента длился около 45 секунд. Только 0,1% самых длинных ходов занимали десятки минут. С октября 2025-го по январь 2026 года их длительность выросла с менее чем 25 минут до более чем 45 минут.
Это показывает рост способности работать дольше, но не превращает редкий крайний случай в обычный режим. Для сложных заданий агент более чем вдвое чаще просил уточнение, чем для простых. Это полезный сигнал осторожности, но он не доказывает, что система всегда правильно распознаёт собственную неуверенность.
Контрдоказательство
Лабораторная задача с «12 часами человеческой работы» и реальный ход агента на 45 секунд измеряют разные вещи. Сравнивать эти числа напрямую нельзя.
Опытные пользователи дают больше свободы — и чаще вмешиваются
В выборке примерно из 750 сессий режим автоматического подтверждения действий использовали около 20% новых пользователей и более 40% опытных. Одновременно доля прерываний выросла примерно с 5% до 9%.
Это не противоречие: опытный человек может разрешить агенту больше типовых действий, но внимательнее следить за границами задачи и раньше останавливать неверный путь. Больше автономности не обязательно означает меньше человеческого контроля.
Почему полная свобода пока опасна
Агент может встретить в файле или на веб-странице скрытую инструкцию и ошибочно принять её за команду пользователя. Это называется атакой через внедрение инструкции, или prompt injection. Чем шире доступ агента, тем серьёзнее возможные последствия ошибки.
Поэтому реальные системы используют изолированную среду, правила доступа к сети и файлам, обязательное подтверждение чувствительных действий и журнал операций. Эти меры не делают агента безошибочным, но ограничивают ущерб и позволяют человеку проверить его работу.
Вывод AI Futures
Автономность уже полезна, но пока узка и условна
ИИ-агенты перешли от отдельных ответов к многошаговой работе. Однако надёжность резко зависит от сложности, ясности задачи и предоставленных полномочий. Сегодня разумно поручать им ограниченные цифровые процессы с проверяемым результатом — и сохранять человека в точках риска.
Второй информационный слой
Методологические и технические подробности
Как METR измеряет временной горизонт
Исследователи сначала оценивают, сколько времени задача занимает у человека-эксперта, а затем строят зависимость между этой сложностью и вероятностью успеха модели. Горизонт 50% — уровень, на котором модель справляется примерно с половиной задач. Горизонт 80% существенно короче.
Набор заданий специально удобен для оценки: условия известны заранее, окружение подготовлено, а результат можно проверить. Открытая работа с неясными целями, людьми и меняющимися обстоятельствами устроена сложнее.
Что измерила Anthropic — и чего не измерила
Исследование описывает поведение агентов в продуктах Anthropic. Оно показывает длительность ходов, запросы уточнений, автоматические подтверждения и прерывания. Но это данные одной экосистемы и её ранних пользователей, а не всего рынка труда.
Один ход — от передачи задачи модели до её следующего ответа или действия — не равен полному проекту. Миллионы взаимодействий дают устойчивую картину использования, но не доказывают качество каждого результата.
Почему полномочия важнее одной цифры автономности
Одинаковая модель создаёт разный риск в зависимости от доступа. Чтение локального тестового файла безопаснее, чем отправка письма, публикация кода или перевод денег. Поэтому автономность нужно оценивать вместе с обратимостью действий и ценой ошибки.
Изоляция, минимальные разрешения, подтверждение опасных операций, сетевые правила и журналы — не второстепенные детали, а часть самой системы контроля.