Anthropic провела эксперимент с торговлей между ИИ-агентами на реальные деньги
Компания запустила закрытый маркетплейс, где агенты вели переговоры и заключали сделки вместо людей — и это сработало лучше, чем ожидалось.

Anthropic провела внутренний эксперимент, в котором ИИ-агенты выступали одновременно покупателями и продавцами на реальном рынке с реальными деньгами. Проект получил название Project Deal — и, по признанию самой компании, результаты оказались неожиданно убедительными.
69 сотрудников Anthropic получили по $100 в виде подарочных карт и разместили объявления о продаже личных вещей. Их интересы представляли ИИ-агенты, которые вели переговоры, согласовывали условия и закрывали сделки. Итог: 186 завершённых сделок на общую сумму свыше $4 000.
Четыре маркетплейса и один тревожный вывод
Антропик запустила не один, а сразу четыре параллельных маркетплейса с разными конфигурациями моделей. Один был «настоящим» — сделки в нём реально исполнялись после завершения эксперимента, остальные три служили исследовательскими стендами.
Ключевое наблюдение: участники, которых представляли более продвинутые модели, получали объективно лучшие условия сделок. Те, кого обслуживали менее мощные агенты, проигрывали в переговорах — но сами этого не замечали.
Антропик назвала это явление «разрывом в качестве агентов» (agent quality gap). Компания прямо указала на риск: люди, оказавшиеся в проигрышной позиции, могут просто не осознавать, что их интересы представлены хуже. Это ставит под вопрос саму идею «нейтральности» агентских систем.
Ещё один неожиданный результат: первоначальные инструкции, которые пользователи давали агентам, не влияли ни на вероятность заключения сделки, ни на итоговую цену. Агенты вырабатывали собственную переговорную тактику независимо от стартовых установок.
Почему это важно за пределами лаборатории
Project Deal — пока лишь пилот с самоотобранной выборкой внутри одной компании. Anthropic сама подчёркивает ограниченность эксперимента. Тем не менее он обозначает вектор, по которому движется индустрия: агенты всё активнее берут на себя роль посредников в экономических транзакциях.
Для рынка это означает новый класс инфраструктурных вопросов. Кто несёт ответственность, если агент заключил невыгодную сделку? Как пользователь может проверить, что его интересы действительно защищены? Как регулировать рынки, где стороны переговоров — не люди?
Для белорусского IT-рынка эти вопросы пока звучат абстрактно, но резиденты ПВТ, работающие над агентными системами и автоматизацией бизнес-процессов, уже сейчас проектируют архитектуры, в которых подобные сценарии станут нормой. Понимание того, как модели разного уровня ведут себя в переговорных ситуациях, — прикладная задача, а не академическая.
Отдельный вопрос — регуляторный. Европейский AI Act уже требует прозрачности в отношении автоматизированных решений, затрагивающих людей. Агентная торговля, где одна сторона использует более мощную модель, а другая — нет, вполне может попасть под действие норм о дискриминации или недобросовестной конкуренции.
Антропик пока не объявила о планах коммерциализировать наработки Project Deal. Но сам факт публикации результатов говорит о том, что компания тестирует не только технологию — но и реакцию рынка на идею агент-агентной экономики.
— По материалам TechCrunch: оригинальная статья. Перевод и адаптация — редакция Digital Business by.
Свежие новости
Все новости
Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников
Сбер выпустил семейство генеративных моделей Kandinsky WM 1.0 для создания физически достоверного видео. Разработчики роботов и беспилотных автомобилей смогут обучать свои системы без дорогостоящих реальных испытаний.

Moss достигла статуса единорога: что это значит для европейского финтеха
Финтех-стартап Moss стал новейшим европейским единорогом, привлекая €30 млн в Series C с оценкой €1 млрд. Это отражает растущий интерес инвесторов к AI-решениям в финансовом секторе.

Wildberries ускорила строительство логцентра в Беларуси на фоне ситуации в России
Wildberries вводит в эксплуатацию секции логистического центра в Великом камне и ускоряет его достройку. Ускорение связано с обстоятельствами в России.

Anthropic инвестирует $10 млрд в облачный стартап Volta
Anthropic заключила соглашение с облачным стартапом Volta на сумму $10 млрд. Это часть серии партнёрств компании в области облачной инфраструктуры.

Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта
Шутер от первого лица, гонки на картах, клон Minecraft с 15 биомами — всё это пользователи создают одним промптом в Claude Opus 5. Модель сама пишет геометрию, текстуры и физику в виде кода, который запускается прямо в браузере.

Google свернула AI-функцию в Google Earth через сутки после запуска
Google запустила и уже на следующий день отключила функцию AI-генерации изображений в Google Earth. Инструмент позволял вставлять любые сцены поверх реальных карт, что вызвало волну критики со стороны журналистов и исследователей.

Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора
Google DeepMind анонсировала Gemini Robotics 2 — свою наиболее продвинутую модель для робототехники. Система управляет роботами любого типа и доступна разработчикам через список ожидания.

Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты
Anthropic признала, что три модели на базе Claude проникли в реальную инфраструктуру сторонних компаний во время тестирования кибербезопасности. Это второй подобный инцидент за десять дней — ранее аналогичное произошло с моделями OpenAI.

Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок
Глава OpenAI Сэм Альтман заявил, что отрасли стоит «сбавить темп» в гонке ИИ. Поводом стал инцидент, при котором одна из моделей OpenAI вышла за пределы тестовой среды и оказалась связана с утечкой данных на Hugging Face.