541

Claude обвинили в лени после провала с письмами

Opus 5 пропустил часть переписки, хотя должен был разобрать всю цепочку, и без спора признал промах.

Claude обвинили в лени после провала с письмами
Пользователь поручил Opus 5 разобрать важные письма, но модель пропустила конец одной цепочки. Когда на ошибку указали, Claude не стал спорить и ответил, что просто не прочитал сообщение.


Жалоба на «ленивый» Claude появилась 4 августа в X. Пользователь с ником Chubby сообщил, что попросил чат-бота просмотреть почтовый ящик, найти важные письма, кратко пересказать их и подготовить ответы. В одной из переписок модель не дошла до последних сообщений, хотя именно там находилась актуальная часть разговора.

После замечания Claude Opus 5, судя по опубликованному пересказу диалога, ответил предельно прямо: «Справедливое замечание. Я этого не прочитал». Для автора поста это стало последней каплей. Он написал, что собирается отменить подписку, поскольку за помощником приходится постоянно следить и отдельно проверять, закончил ли тот порученную работу. На приложенном скриншоте публикация уже набрала 130 тысяч просмотров.

Формально Claude не признал, что «филонил». Он признал конкретный пропуск. Слово «лень» появилось в оценке пользователя и быстро стало удачным человеческим объяснением поведения системы: ей дали задачу, она сделала удобную часть, отчиталась о результате и оставила незамеченным то, ради чего её вообще подключили.

Эпизод особенно заметен на фоне обещаний Anthropic. Модель Opus 5 вышла 24 июля и была представлена как сильнейшая версия Claude для подписчиков Pro, рассчитанная на повседневную интеллектуальную и агентную работу. Компания отдельно подчёркивала, что модель лучше проверяет собственные действия, внимательнее доводит многошаговые задачи до конца и увереннее работает с большими объёмами контекста.

Один неудачный разбор почты не опровергает эти заявления. Публикация в X не является контролируемым тестом: неизвестны точная формулировка запроса, длина переписки, способ подключения почты, набор доступных инструментов и то, какие письма фактически получил Claude. По одному посту нельзя установить, был ли это сбой конкретной сессии, ошибка коннектора или поведение самой модели.

Но жалоба попала в реальную слабую точку современных ИИ-помощников. Пользователь видит единый интерфейс и формулирует поручение как человеку, а модель выполняет его через последовательность отдельных действий: ищет письма, получает результаты от коннектора, выбирает нужные фрагменты, читает их, составляет сводку и при необходимости готовит черновик ответа. Ошибка на любом этапе может выглядеть как законченная работа, если система не провела финальную сверку.

Размер контекстного окна сам по себе проблему не решает. Миллион токенов означает, что модель технически способна удерживать очень большой объём текста, но не гарантирует, что нужное письмо было найдено, полностью передано инструментом и признано важным. В офисной задаче качество зависит не только от «ума» модели, но и от поиска, доступа, порядка вызова инструментов и проверки результата.

С почтой есть ещё одно ограничение. Официальный коннектор Google Workspace позволяет Claude искать сообщения и создавать черновики, однако отправка остаётся за владельцем аккаунта. Это разумная мера безопасности, но она показывает, насколько условно слово «помощник»: система может подготовить действие, а ответственность за полноту, адресата и итоговую отправку всё равно лежит на человеке.

Похожие жалобы на Opus 5 уже появляются в пользовательских сообществах. Одни пишут, что модель останавливается посреди длинной задачи, другие — что она игнорирует часть инструкций или требует повторных напоминаний. Эти отзывы нельзя складывать в статистику качества: люди чаще рассказывают о провалах, условия работы различаются, а удачные сессии почти не становятся отдельными публикациями. Тем не менее повторяющийся мотив важен — обещанная автономность пока не отменяет человеческого контроля.

Отсюда и шутка о будущем рынка труда. Работодателям много лет обещают, что ИИ заменит сотрудников, которым нужно объяснять задачу, напоминать о сроках и проверять результат. На практике рядом с новым цифровым работником появляется новая обязанность: уточнить поручение, убедиться, что он прочитал всё, потребовать продолжения и затем перепроверить отчёт.

Это не человеческая лень в буквальном смысле. У модели нет желания сэкономить силы или уйти пораньше. «Ленивым» выглядит результат, когда система преждевременно решает, что уже сделала достаточно, и формирует уверенный ответ без последней проверки. Для пользователя различие почти философское: оплачивается не внутренняя причина ошибки, а завершённая работа.


Самая ироничная часть истории не в том, что ИИ оказался похож на нерадивого сотрудника. Она в том, что человек незаметно получил должность его руководителя — без отдельной зарплаты, но с обязанностью читать переписку вслед за ним.

Фото: редакция ИЗНАНКИ.

Следите за новостями в наших соцсетях



Улыбка может стать причиной финансовых потерь: за год зафиксировано 43 случая ...

/ / Интересное Автор: Денис Иванов

А долги достигли триллиона рублей

/ / Интересное Автор: Дмитрий Зорин

Препарат MVA-BN, разработанный компанией Bavarian Nordic, получил официальное ...

/ / Интересное Автор: Дарья Никитская