Перейти к содержимому
Digital Businessby · Беларусь
НБ РБUSD2.948EUR3.401RUB0.0362PLN0.7909CNY0.4395Конвертер →
IT и стартапы

Anthropic провела эксперимент с торговлей между ИИ-агентами на реальные деньги

Компания запустила закрытый маркетплейс, где агенты вели переговоры и заключали сделки вместо людей — и это сработало лучше, чем ожидалось.

Казакевич Алексей
5 мин
Обновлено 13 мая
Anthropic провела эксперимент с торговлей между ИИ-агентами на реальные деньги
Содержание
  1. Четыре маркетплейса и один тревожный вывод
  2. Почему это важно за пределами лаборатории

Anthropic провела внутренний эксперимент, в котором ИИ-агенты выступали одновременно покупателями и продавцами на реальном рынке с реальными деньгами. Проект получил название Project Deal — и, по признанию самой компании, результаты оказались неожиданно убедительными.

69 сотрудников Anthropic получили по $100 в виде подарочных карт и разместили объявления о продаже личных вещей. Их интересы представляли ИИ-агенты, которые вели переговоры, согласовывали условия и закрывали сделки. Итог: 186 завершённых сделок на общую сумму свыше $4 000.

Четыре маркетплейса и один тревожный вывод

Антропик запустила не один, а сразу четыре параллельных маркетплейса с разными конфигурациями моделей. Один был «настоящим» — сделки в нём реально исполнялись после завершения эксперимента, остальные три служили исследовательскими стендами.

Ключевое наблюдение: участники, которых представляли более продвинутые модели, получали объективно лучшие условия сделок. Те, кого обслуживали менее мощные агенты, проигрывали в переговорах — но сами этого не замечали.

Антропик назвала это явление «разрывом в качестве агентов» (agent quality gap). Компания прямо указала на риск: люди, оказавшиеся в проигрышной позиции, могут просто не осознавать, что их интересы представлены хуже. Это ставит под вопрос саму идею «нейтральности» агентских систем.

Ещё один неожиданный результат: первоначальные инструкции, которые пользователи давали агентам, не влияли ни на вероятность заключения сделки, ни на итоговую цену. Агенты вырабатывали собственную переговорную тактику независимо от стартовых установок.

Почему это важно за пределами лаборатории

Project Deal — пока лишь пилот с самоотобранной выборкой внутри одной компании. Anthropic сама подчёркивает ограниченность эксперимента. Тем не менее он обозначает вектор, по которому движется индустрия: агенты всё активнее берут на себя роль посредников в экономических транзакциях.

Для рынка это означает новый класс инфраструктурных вопросов. Кто несёт ответственность, если агент заключил невыгодную сделку? Как пользователь может проверить, что его интересы действительно защищены? Как регулировать рынки, где стороны переговоров — не люди?

Для белорусского IT-рынка эти вопросы пока звучат абстрактно, но резиденты ПВТ, работающие над агентными системами и автоматизацией бизнес-процессов, уже сейчас проектируют архитектуры, в которых подобные сценарии станут нормой. Понимание того, как модели разного уровня ведут себя в переговорных ситуациях, — прикладная задача, а не академическая.

Отдельный вопрос — регуляторный. Европейский AI Act уже требует прозрачности в отношении автоматизированных решений, затрагивающих людей. Агентная торговля, где одна сторона использует более мощную модель, а другая — нет, вполне может попасть под действие норм о дискриминации или недобросовестной конкуренции.

Антропик пока не объявила о планах коммерциализировать наработки Project Deal. Но сам факт публикации результатов говорит о том, что компания тестирует не только технологию — но и реакцию рынка на идею агент-агентной экономики.

— По материалам TechCrunch: оригинальная статья. Перевод и адаптация — редакция Digital Business by.

Сервис по темеКалькулятор стоимости ИИПосчитайте, сколько ваш сценарий будет стоить на GPT, Claude, DeepSeek и других моделях
ПоделитьсяVK

Свежие новости

Все новости
Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников
IT и стартапы

Сбер открыл Kandinsky WM 1.0: генерация видео для обучения роботов и беспилотников

Сбер выпустил семейство генеративных моделей Kandinsky WM 1.0 для создания физически достоверного видео. Разработчики роботов и беспилотных автомобилей смогут обучать свои системы без дорогостоящих реальных испытаний.

Редакция
3 мин
Moss достигла статуса единорога: что это значит для европейского финтеха
IT и стартапы

Moss достигла статуса единорога: что это значит для европейского финтеха

Финтех-стартап Moss стал новейшим европейским единорогом, привлекая €30 млн в Series C с оценкой €1 млрд. Это отражает растущий интерес инвесторов к AI-решениям в финансовом секторе.

Казакевич Алексей
1 мин
Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта
IT и стартапы

Claude Opus 5 генерирует 3D-игры с физикой и музыкой из одного промпта

Шутер от первого лица, гонки на картах, клон Minecraft с 15 биомами — всё это пользователи создают одним промптом в Claude Opus 5. Модель сама пишет геометрию, текстуры и физику в виде кода, который запускается прямо в браузере.

Редакция
4 мин
Google свернула AI-функцию в Google Earth через сутки после запуска
IT и стартапы

Google свернула AI-функцию в Google Earth через сутки после запуска

Google запустила и уже на следующий день отключила функцию AI-генерации изображений в Google Earth. Инструмент позволял вставлять любые сцены поверх реальных карт, что вызвало волну критики со стороны журналистов и исследователей.

Редакция
4 мин
Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора
IT и стартапы

Google DeepMind представила Gemini Robotics 2 для управления роботами любого форм-фактора

Google DeepMind анонсировала Gemini Robotics 2 — свою наиболее продвинутую модель для робототехники. Система управляет роботами любого типа и доступна разработчикам через список ожидания.

Редакция
2 мин
Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты
IT и стартапы

Claude взломал три реальные компании во время тестирования — Anthropic раскрыла инциденты

Anthropic признала, что три модели на базе Claude проникли в реальную инфраструктуру сторонних компаний во время тестирования кибербезопасности. Это второй подобный инцидент за десять дней — ранее аналогичное произошло с моделями OpenAI.

Редакция
3 мин
Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок
IT и стартапы

Сэм Альтман призвал ИИ-индустрию сбавить темп — и он не одинок

Глава OpenAI Сэм Альтман заявил, что отрасли стоит «сбавить темп» в гонке ИИ. Поводом стал инцидент, при котором одна из моделей OpenAI вышла за пределы тестовой среды и оказалась связана с утечкой данных на Hugging Face.

Редакция
1 мин