Новости и статьи об искусственном интеллекте и нейросетях. Мы собираем и обрабатываем самую актуальную информацию из мира AI. О проекте
Outshift разрабатывает многослойную архитектуру для совместной работы ИИ-агентов, включая протоколы «Интернета познания» и «Интернета агентов». Это позволяет агентам разделять намерения, контекст и рассуждения, повышая успешность решений с 33% до 93%. Концепция приближает создание распределённого искусственного суперинтеллекта.
Материал объясняет, почему для AI-агентов критически важно централизованное управление идентичностью и федеративное доверие к существующим системам. Разбираются открытые стандарты (SPIFFE, WIMSE, OIDC), границы применимости в разных доменах доверия и необходимость масштабирования контроля под радиус поражения каждого агента.
Управление пятью агентами — это проверка, а пятьюстами — задача для инфраструктуры. Чтобы избежать хаоса, предприятиям нужны централизованная идентификация, единые политики и межсредовое принуждение. Эти механизмы становятся основой безопасной работы с агентами в масштабе.
Статья объясняет, что первоклассная агентская идентичность включает отдельный субъект, ограниченные разрешения, владельца и независимый механизм отзыва. Является ли она просто идентичностью рабочей нагрузки, зависит от трёх инвариантов: однозначного соответствия, реестра как источника истины и непрерывности идентичности. Платформы Microsoft Entra Agent ID и AWS Bedrock AgentCore добавляют дополнительный уровень, когда эти инварианты нарушаются.
Data2Story — система из семи ИИ-агентов, автоматически создающая интерактивные мультимодальные статьи из CSV-файлов. Она обеспечивает высокую проверяемость утверждений, связывая каждое с кодом или источником. В тестах с читателями статьи агента получили более высокие оценки, чем написанные людьми.
Команда DataRobot представила агента, который самостоятельно пишет инструменты для взаимодействия с внешними сервисами, избавляя разработчиков от рутинного кодинга.
Anthropic провела эксперимент Project Deal, где агенты Claude торговали для сотрудников: модели Opus 4.5 выигрывали на $2-3 за сделку по сравнению с Haiku 4.5. Участники с слабыми агентами оценили公平ность так же высоко и не заметили потерь. Тест поднимает вопросы о рисках ИИ-коммерции и неравенстве.
GoZTASP — платформа нулевого доверия для управления автономными системами миссионного масштаба, интегрирует дроны, роботы и сенсоры с помощью SRTA и SSTR. Достигла TRL 7 в реальных миссиях, компоненты вроде Saluki — TRL 8. Применяется в здравоохранении, транспорте и инфраструктуре.
Разбор пяти фундаментальных концепций создания рабочих агентных систем: подключение инструментов через MCP организация памяти переход от промтов к контекстной инженерии циклы планирования оркестрация нескольких агентов и обязательная наблюдаемость без которой около 88% проектов проваливаются.
OpenAI внедрила шифрование коммуникаций между основным агентом Codex и его субагентами — теперь история сессии показывает нечитаемые строки вместо описания задач.
Винт Серф, один из создателей протоколов интернета, покинул Google и присоединился к Innovation Labs в качестве советника. Компания разрабатывает DNSid — открытый стандарт для идентификации и аудита ИИ-агентов через доменные имена, что должно повысить доверие к автономным агентам. Серф считает, что широкое внедрение таких систем зависит от функциональности и давления пользователей.
Профессия data scientist смещается от построения моделей к управлению ИИ-системами: надзор за мультиагентными рабочими процессами, промпт-инжиниринг, оценка и управление рисками. Зарплаты специалистов с этими навыками растут, а спрос на них опережает предложение.
Google DeepMind совместно с Schmidt Sciences, ARIA и другими объявили о финансировании в $10 млн для исследований безопасности мультиагентных систем. Цель — изучить риски, возникающие при массовом взаимодействии ИИ-агентов, включая мошенничество и кибератаки, и разработать меры предотвращения опасных сценариев.
Презентация от APL Джонса Хопкинса посвящена агентному ИИ для совместной работы роботов. Рассматриваются вызовы автономности, координации и адаптивности, а также масштабируемая архитектура для мультиагентного поведения. Приведены демонстрации на реальном оборудовании и извлеченные уроки.
Стартап Verkor.io применил ИИ-агента Design Conductor для автономного создания ядра RISC-V процессора VerCore на 1,48 ГГц с результатом CoreMark 3261, как у Intel Celeron SU2300 2011 года. Дизайн занял 12 часов от промпта до GDSII-файла, это первое полное ядро от ИИ. Файлы опубликуют в апреле, с демонстрацией на FPGA.
Ученые Stanford выяснили: многозагентные ИИ-системы выигрывают в основном за счет большего объема вычислений, одиночные агенты при равных ресурсах не уступают. Команды полезны при длинных контекстах, зашумленных данных и слабых моделях, особенно в дебатах.