whynotroman

Новость · 9 окт 2026 · 6 мин

Как работать с ИИ, 9 октября. Пять приёмов: проси доказательство и ставь лимит расходов

Пять советов от Anthropic и Саймона Уиллисона простым языком. Как просить у ИИ доказательство, проверять цифры в дашборде, включать рассуждение для расчётов, ставить лимит расходов и ограничивать доступ. К каждому совету показываю, как применить его в продаже автомобилей.

Сегодня я выбрал пять приёмов, которые можно применить в тот же день. Три из них про то, как не поверить ИИ на слово. Два про деньги и доступы, где ошибка стоит дорого.

К каждому совету добавил своё мнение. Как это работает в продаже автомобилей и в разговоре с человеком, который выбирает машину.

Назови агенту доказательство, что задача выполнена

Команда Anthropic опубликовала в блоге Claude Code руководство по облачным сессиям. Главный приём в нём про постановку задачи. Напиши, что не так, как выглядит результат и чем агент это докажет. Одна задача на одну сессию.

В примере агенту поручили починить нестабильный тест и доказать это запуском набора не меньше 30 раз подряд. Он запустил 40 раз, ошибок не было. В другой сессии агент поднял сервер и проверил каждый адрес запросом. Так нашлись пять ошибок, которые не видны при чтении кода. Проверять результат нужно по доказательству, а потом уже читать пересказ агента.

Простыми словами. Не проси «сделай». Проси «сделай и покажи, как ты проверил».

Что я думаю. Клиент спросил про модель в кредит. Если просто попросить ответ, платёж возьмётся неизвестно откуда.

Я бы писал так. «Ответь клиенту про кредит на эту модель. Ставку возьми только из вложенного документа. В конце покажи расчёт платежа по шагам и назови строку документа, откуда взята ставка».

Дальше я пересчитываю один вариант сам. ИИ готовит, человек решает и отвечает за цифру. Цена в письме клиенту это твоё обещание.

Источник Claude Code blog

Нажми на цифру в дашборде и прочитай, как её посчитали

Anthropic 8 октября выпустила в бета-версии Claude Dashboards. Дашборд собирается из вопроса простым языком и обновляется вместе с данными. Подключение идёт к хранилищам вроде BigQuery, Snowflake и Databricks, а ещё к CRM Salesforce.

Каждая цифра открывается. Нажимаешь на число и видишь запрос, который его посчитал. На графике стоит время последнего обновления. Дашборды доступны на платных тарифах. У корпоративных администраторов функция по умолчанию выключена.

Простыми словами. Красивой цифре верить нельзя. Открой, как она получилась, и сверь одну строку руками.

Что я думаю. Руководитель продаж просит дашборд «время первого ответа по источникам заявок». Цифра выходит приятная. Я бы нажал на неё и проверил, вошли ли в расчёт ночные заявки и заявки по телефону. Если нет, средний ответ выглядит быстрее, чем есть.

Потом я бы выписал менеджеров, у которых ответ дольше часа. ИИ не заменяет менеджера, он показывает, кто не делал работу. Автомобильных систем DMS среди подключений нет, и первый вопрос к поставщику про выгрузку из неё.

Источник Claude

Включай режим рассуждения, когда просишь ИИ считать

Саймон Уиллисон, разработчик и автор блога об ИИ, проверил модель Qwen 3.8 на сложении чисел. Модель запускалась у него на компьютере. Ответ нужно было написать словами. Это повтор теста, который Колин Фрейзер делал на GPT-4o два года назад.

Без рассуждения модель посчитала верно 23,6% примеров. С трёхзначными числами было 97%, а с числами от 10 до 13 знаков только 6,4%. С включённым рассуждением средней глубины верными оказались 167 из 169 примеров. Это пробный запуск, по одному примеру на каждую длину числа, поэтому Уиллисон ждёт других цифр при повторе.

Простыми словами. Без «подумай» ИИ пишет цифры по памяти и ошибается на длинных числах. С рассуждением он считает по шагам.

Что я думаю. Платёж по кредиту, остаточная стоимость, разница в цене трейд-ина. Это те самые вычисления, где без рассуждения модель уверенно пишет красивую ошибку. В ChatGPT и Claude я бы включал режим с рассуждением всякий раз, когда в запросе есть деньги.

И добавлял фразу в запрос. «Покажи расчёт по шагам». Если шагов нет, цифре верить нельзя. Результат одного пробного запуска ещё не гарантия, одну проверку руками я оставлю всегда.

Источник Simon Willison's Weblog

Поставь жёсткий лимит расходов там, где работает агент

Уиллисон 3 октября написал, что платным сервисам нужен жёсткий лимит расходов по умолчанию. Предупреждение по почте не останавливает расход. Лимит возвращает ошибку, когда месячный бюджет кончился. По его мнению, агенты делают расходы легко достижимыми, и счёт растёт, пока хозяин спит.

Он приводит движение в этом направлении. Amazon Web Services запустил лимиты расходов в сентябре, проект ставится на паузу до конца месяца. Функция пока доступна не всем клиентам. Google Cloud добавил Spend Caps в июле. Уиллисон хочет, чтобы агенты советовали сервисы с жёстким лимитом.

Простыми словами. Лучше получить отказ в конце месяца, чем счёт на тысячи долларов утром.

Что я думаю. Дилер подключил ИИ-агента к ночным заявкам и платит за каждый ответ. Если зациклится диалог или кто-то запустит рассылку, счёт растёт без звонка. Я бы спросил у поставщика одну вещь. «Какой лимит расходов в месяц стоит у нас и что происходит, когда он достигнут».

Хороший ответ звучит так. Агент остановлен, мне пришло письмо, клиентам идёт сообщение, что менеджер ответит утром. Плохой ответ звучит как «у нас безлимит».

Источник Simon Willison's Weblog

Открывай агенту только тот доступ, без которого он не справится

В том же руководстве Anthropic описаны уровни доступа к сети. «Нет» для чужого кода, «доверенный» для обычных репозиториев, «свой» для частных сервисов и «полный» только когда иначе нельзя. Переменные среды видны всем, кто работает в этой среде, поэтому секреты там хранить нельзя.

Ещё два факта из руководства. Anthropic хранит запись сессии, срок зависит от тарифа и настройки улучшения моделей. Даже при доступе «нет» запросы к API Anthropic продолжают уходить, так что информация может покинуть среду.

Простыми словами. Дай агенту ровно столько прав, сколько нужно для задачи. Всё остальное закрой и не клади пароли туда, где их видят другие.

Что я думаю. В салоне это про таблицу с телефонами клиентов. Я бы загружал в ИИ выгрузку без телефонов и фамилий. Для проверки ответа хватит номера обращения, модели и текста вопроса.

Потом я бы открыл политику хранения у выбранного сервиса и записал одну строку. Где лежат диалоги и сколько дней. Не знаешь срока, не загружай сведения о клиентах. Юристу такую строку нужно показать до начала работы, а не после утечки.

Источник Claude Code blog

Что посмотреть

Это свежие выпуски и доклады за двое суток. Я их ещё не разбирал, описание даю по названию.

Следующая статья · 6 минКак работать с ИИ, 10 октября. Пять приёмов: читай от закладки и подтверждай отправку →Пять советов от Anthropic и Саймона Уиллисона простым языком. Как не терять заявки в отчёте агента, не принимать сбой за тихий день, проверять статус перед отправкой и не давать агенту подавать формы без твоего «да». К каждому совету показываю, как применить его в продаже автомобилей.

Роман Спицын. Строю отделы продаж, где ИИ-агенты делают работу, а люди закрывают сделки.

Читать дальше

← Все статьи