logo

Founders Fund, Pantera и Franklin Templeton присоединяются к «Арене» Sentient для проведения стресс-тестирования ИИ-агентов корпоративного уровня

By: rootdata|2026/03/20 01:14:33
0
Поделиться
copy

В последние два года компании ускорили интеграцию ИИ-агентов в реальные рабочие процессы: от обслуживания клиентов и бэкэнд-операций до финансовых и комплаенс-процессов, требующих принятия решений с высокими ставками. Поскольку эти системы все чаще внедряются в реальные бизнес-процессы, возникает новая проблема: хотя агенты могут извлекать информацию, им часто сложно обеспечить стабильные, интерпретируемые и воспроизводимые процессы рассуждения, когда работа становится «беспорядочной», многоэтапной или сопряженной с высоким риском.

Сегодня лаборатория открытого исходного кода Sentient официально запустила Arena — готовую к производству среду реального времени, в которой тысячи разработчиков искусственного интеллекта по всему миру могут проводить стресс-тестирование и соревноваться в решении самых сложных задач, с которыми сталкиваются предприятия. В первоначальный состав участников первой фазы Arena входят Founders Fund, Pantera и Franklin Templeton, которая управляет активами на сумму более 15 триллионов долларов, что свидетельствует о том, что институты проявляют ранний и явный интерес к «структурированной оценке ИИ-агентов перед их внедрением».

«Когда компании применяют ИИ-агенты в исследованиях, операционной деятельности и рабочих процессах, связанных с обслуживанием клиентов, вопрос уже не в том, достаточно ли мощны эти системы... а в том, насколько они надежны в реальных рабочих процессах», — сказал Джулиан Лав, управляющий партнер Franklin Templeton Digital Assets. Лав добавил, что структурированные среды, такие как Arena, помогут отрасли отличать «многообещающие идеи» от «возможностей, которые действительно можно использовать в производстве».

Соучредитель Sentient Химаншу Тьяги заявил: «ИИ-агенты больше не являются просто экспериментами внутри компаний; они входят в критически важные процессы, которые затрагивают клиентов, финансирование и операционные результаты». Это изменение влияет на критерии оценки. Недостаточно, чтобы системы выглядели впечатляюще в демонстрационных версиях. Компаниям необходимо знать: в производственных средах, где стоимость сбоев высока, а доверие хрупко, могут ли агенты по-прежнему надежно рассуждать? Бизнесу нужна сопоставимость, повторяемость и метод отслеживания улучшений надежности в долгосрочной перспективе, который не зависит от базовой модели или набора инструментов».

Arena имитирует реальный хаос рабочих процессов в предприятии: неполная информация, длинный контекст, неясные инструкции и противоречивые источники. Arena не просто оценивает, дают ли агенты «правильные ответы», но и записывает полные следы рассуждений, чтобы инженерные команды могли точно определять причины сбоев и проверять улучшения с течением времени.

Это обеспечивает нейтральный, независимый от поставщиков эталон для оценки рассуждений по различным моделям и технологическим стекам. Arena делает акцент на производительности на уровне производства, а не на демонстрационной производительности, тем самым формируя проверяемые возможности агентов, применимые к сценариям с высоким уровнем риска, которые предприятия также могут переносить на свои частные данные и внутренние инструменты.

В первом испытании разработчики, присоединившиеся к Arena, сосредоточатся на фундаментальной проблеме корпоративного уровня: рассуждениях на основе документов. ИИ-агенты должны анализировать и обрабатывать сложные неструктурированные данные — этот тип работы лежит в основе таких сценариев, как финансовый анализ, исследование первопричин, написание инвестиционных меморандумов и обслуживание клиентов.

Другими участниками начальной фазы являются alphaXiv, Fireworks, OpenHands и OpenRouter; по мере расширения Arena в области задач, отраслей и интеграции моделей ожидается присоединение новых участников.

Недавние исследования также подчеркивают пробел, который Arena стремится устранить: 85% компаний выражают желание стать «агентными предприятиями», причем почти три четверти из них планируют внедрить автономных агентов, но менее четверти фактически имеют зрелые системы управления; многие компании испытывают трудности с масштабированием пилотных проектов до крупномасштабного внедрения в производство. В среднем компании используют около дюжины агентов, часто разбросанных по изолированным сценариям; многие считают, что без более эффективных возможностей координации и сотрудничества добавление дополнительных агентов только увеличит сложность и снизит ценность.

«В OpenHands мы всегда стремились поддерживать разработчиков в использовании агентов для решения реальных практических задач», — сказал Грэм Нойбиг, главный научный сотрудник и соучредитель OpenHands. «Мы также рады поддержать участников в использовании OpenHands Software Agent SDK для решения этих сложных задач».

Алекс Аталла, соучредитель и генеральный директор OpenRouter, заявил: «Arena — это именно та инициатива, которая может продвинуть открытый исходный код в области искусственного интеллекта — она позволяет исследователям соревноваться, повторять и внедрять инновации в открытой среде». Мы надеемся на углубление сотрудничества с Sentient и предоставление инфраструктуры, которая ускорит проведение экспериментов и упростит их масштабирование».

Arena будет запущена на глобальном уровне, приглашая тысячи разработчиков ИИ подать заявки на участие в первой ограниченной группе, а офлайн-мероприятия запланированы в Сан-Франциско с марта 2026 года.

О компании Sentient Labs

Sentient Labs — ведущая организация в области технологических исследований и разработки продуктов, занимающаяся продвижением искусственного интеллекта с открытым исходным кодом. Являясь двигателем инноваций Sentient Foundation, Sentient Labs проводит передовые исследования в области искусственного интеллекта, согласования и сотрудничества агентов. Sentient является основным разработчиком высокопроизводительных фреймворков, таких как ROMA, и моделей с открытым исходным кодом, таких как Dobby. Миссия Sentient заключается в том, чтобы превратить искусственный интеллект с открытым исходным кодом из «эксперимента» в «необходимость». Предоставляя инфраструктуру для создания мощных, компоновных агентских систем, Sentient позволяет разработчикам коммерциализировать инструменты с открытым исходным кодом и достигать уровня удобства использования, приемлемого для предприятий. Sentient стремится сделать открытый исходный код стандартом по умолчанию для глобальных критически важных операций искусственного интеллекта.

Цена --

--

Вам также может понравиться

Соучредитель Polygon Сандип: Запись после взрыва цепного моста

За три недели платформы Drift, Hyperbridge и KelpDAO были атакованы с разницей в несколько недель, что привело к потерям почти в $900 миллионов. CEO Polygon написал, что проблема не в какой-то одной команде, а в архитектуре "нотариального" стиля, общей для всей индустрии, которая полагается на одного или двух подписчиков для утверждения мошеннических транзакций...

Значительное обновление веб-версии: Более 10 расширенных стилей диаграмм для более глубокого анализа рынка.

Для предоставления более мощных и профессиональных инструментов анализа компания WEEX выпустила масштабное обновление своих веб-графиков для торговли — теперь они поддерживают до 14 расширенных стилей графиков.

Утренний отчет | Aethir заключает контракт с компанией Axe Compute на сумму 260 миллионов долларов; New Fire Technology приобретает торговую команду Avenir Group; торговый объем Polymarket превышен Kalshi

Обзор важных событий на рынке 23 апреля

Прогноз Цены Биткойна: Крупная Ставка Blackrock на Рынок

BlackRock делает крупнейшую ставку на биткойн, размещая $871 миллионов в ETF за неделю. На фоне волатильности, BTC удерживает…

Токенизированное золото высаживается на Solana: Будет ли Bitcoin Layer 2 следующим для RWA-бома?

OCBC из Сингапура перевела институциональное золото в блокчейн через Solana и Ethereum, сохраняя $525 миллионов в активном управлении.…

Cardano Криптовалюта Удерживает $0.24, Объем ADA Вырос на 48%: Ожидается Восстановление?

Объем торгов Cardano достиг $600 млн, что является редким явлением и усиливает интерес к валюте. Несмотря на удержание…

Содержание

Популярные монеты

Последние новости криптовалют

Еще