CHI AI Trendwatch
13 сентября 2026
AI-неделя: агенты получили доступ к приложениям, данным и внешнему миру
Семь историй о новых агентах, визуальной работе, корпоративных данных, науке и цене доверия.
На этой неделе AI-системы двигались от ответа к действию. Meta дала персональному агенту доступ к приложениям, OpenAI связала агентов с корпоративными данными и длительными процессами, а визуальный редактор получил более точные способы управления.
Вместе с доступом выросла цена ошибки. Поэтому в выпуске отдельно отмечены права, резидентность данных, отсутствие независимых бенчмарков, статус прогнозов и разница между публичным обещанием и завершенной проверкой.
История 01
Meta выпустила агента Muse с доступом к приложениям
8 сентября Meta начала выпуск Muse в США на iOS, Android, muse.ai и в WhatsApp. Агент может работать с почтой, календарями, платежами и браузером, продолжать длинные задачи в фоне и запрашивать подтверждение перед чувствительными действиями.
Почему это касается бизнеса
Muse работает в отдельной облачной виртуальной машине. Отдельный Sentinel контролирует коннекторы и сетевой трафик, а реальные пароли и платежные данные, по заявлению Meta, не показываются основной модели.
Reuters сообщает, что внутренние тесты выявляли зависания и несанкционированное раскрытие чувствительных данных. Meta прямо признает, что агент ошибается; Confidential VM, которая должна технически закрыть доступ Meta к данным, обещана позднее в этом году.
Где это бьет
- запуск ограничен США и идет постепенно;
- агент получает широкий контекст из личных и рабочих сервисов;
- нынешняя Secure VM не исключает технический доступ Meta к данным.
Что продавать
Аудит допуска персонального агента: перечень подключений, минимальные права, сценарии обязательного подтверждения и журнал действий.
У агента появился доступ к приложениям. Главный вопрос теперь — какие действия ему действительно разрешены.
История 02
ChatGPT Images 2.5 получил эскизы и точечные правки
8 сентября OpenAI начала rollout ChatGPT Images 2.5 для всех тарифов ChatGPT, ChatGPT Work и Codex. В интерфейсе появились Sketch, комментарии прямо на изображении, шаблоны и передача промпта вместе с картинкой.
Почему это касается бизнеса
OpenAI заявляет о более точном сохранении объектов и последовательности правок, а также о снижении задержки до 50% по сравнению с Images 2.0. Для API выпущены Flare и более медленный Sunburst.
The Verge в коротком тесте подтвердил работу эскиза и локального изменения цвета глаз. Это ранняя демонстрация, а не независимый сравнительный бенчмарк качества.
Где это бьет
- цифра до 50% — измерение OpenAI;
- многошаговая правка все еще требует проверки каждой версии;
- C2PA и невидимая маркировка помогают с происхождением, но не заменяют редакционный контроль.
Что продавать
Спринт визуальных вариантов: эскиз композиции, три версии, список неизменяемых элементов и финальная проверка текста и бренда.
Эскиз сокращает путь до варианта. Готовность к публикации по-прежнему определяется проверкой.
История 03
Data agent строит дашборды из корпоративных источников
10 сентября OpenAI представила Data agent в ChatGPT Work. Он подключается к одобренным источникам данных, исследует изменения, строит интерактивные дашборды и может выполнить подтвержденные действия через связанные инструменты.
Почему это касается бизнеса
Список интеграций включает Redshift, BigQuery, Databricks, Snowflake, MongoDB, Datadog, Google Drive и SharePoint. Администраторы выбирают подключения и роли, а запросы наследуют ограничения таблиц, строк и столбцов.
VentureBeat отмечает главное доказательное ограничение запуска: OpenAI не опубликовала внешний бенчмарк точности поиска или выводов для продукта. Доступ к данным и красивый дашборд сами по себе не подтверждают правильность метрик.
Где это бьет
- ошибка в определении метрики масштабируется в рекомендации и действия;
- качество зависит от семантического слоя и прав доступа;
- внешняя точность продукта пока не измерена публично.
Что продавать
Пилот Data agent на трех управленческих вопросах: словарь метрик, эталонные ответы, проверка источников и журнал подтвержденных действий.
Разговорный интерфейс упрощает запрос. Он не отменяет определения метрик и сверку с источником.
История 04
AlphaGenome Atlas нанес на карту 9 млрд вариантов ДНК
8 сентября Google DeepMind открыла AlphaGenome Atlas: базу прогнозов для 9 млрд возможных однонуклеотидных изменений человеческого генома. Объем набора составляет около 1 петабайта; веб-портал доступен для некоммерческих исследований.
Почему это касается бизнеса
Atlas заранее рассчитывает возможное влияние вариантов и присваивает им AVI score, чтобы исследователи могли быстрее выбирать кандидатов для проверки. Google приводит результаты на данных 54 000+ участников UK Biobank и пример редкого варианта DNM1.
Nature подчеркивает, что это прогнозная карта. Она помогает расставить приоритеты, но не доказывает причинность и не заменяет лабораторную или клиническую валидацию; коммерческий доступ требует отдельной лицензии.
Где это бьет
- модельный балл легко принять за медицинский вывод;
- одиночные изменения не описывают все комбинации и типы вариантов;
- для коммерческого использования нужны условия Google Cloud.
Что продавать
Разбор AI-научного инструмента для команды: область применимости, цепочка доказательств, лицензия и план экспериментальной проверки.
Девять миллиардов прогнозов ускоряют поиск. Доказательство начинается после прогноза.
История 05
OpenAI открыла Agents API в публичной бете
10 сентября OpenAI открыла всем разработчикам публичную бету Agents API — управляемую оболочку Codex для длительных агентных задач. Она берет на себя сессии, оркестрацию, сжатие контекста и восстановление.
Почему это касается бизнеса
Команда может выбрать песочницу OpenAI, собственную инфраструктуру или партнера; агент умеет выполнять код, работать с файлами, MCP-инструментами и подагентами. Отдельной платы за API нет, но оплачиваются модели, инструменты и контейнеры.
Документация фиксирует существенное ограничение беты: только резидентность данных в США и отсутствие Zero Data Retention. Собственная песочница это ограничение не снимает.
Где это бьет
- интерфейс публичной беты может меняться;
- стоимость складывается из токенов, инструментов и среды исполнения;
- US-only residency и отсутствие ZDR блокируют часть регулируемых сценариев.
Что продавать
Предпроизводственный агентный контур: один ограниченный процесс, бюджет, максимальное число подагентов, журнал инструментов и тест восстановления.
Управляемая оболочка убирает часть инфраструктуры. Контроль данных, бюджета и действий остается у команды.
История 06
Anthropic описала 7 типов злоупотреблений Claude
10 сентября Anthropic опубликовала отчет об операциях, выявленных и остановленных с декабря 2025-го по август 2026-го. В нем 7 направлений вреда: кибероперации, влияние, слежка, мошенничество, биологические риски, оружие и дистилляция моделей.
Почему это касается бизнеса
По данным Anthropic, злоумышленники переходят от вопросов к оркестрации разведки, эксплуатации и вывода данных через многоагентные схемы. В одном описанном российском сценарии планирование затронуло более 20 организаций.
Reuters независимо разобрал заявленные случаи, но первичные атрибуции и оценка вклада AI принадлежат Anthropic. Компания подчеркивает, что это заметные и новые случаи, а не типичное использование Claude.
Где это бьет
- обычные украденные ключи и фишинг получают более быстрый исполнительный слой;
- статическая защита хуже работает против постоянно перестраиваемых инструментов;
- отчет провайдера не равен независимому расследованию каждого эпизода.
Что продавать
Учение по AI-ускоренной атаке: украденный ключ, фишинг, автономное повторение действий, отзыв доступа и проверка журналов.
AI не отменил старые атаки. Он сокращает время и число людей, нужных для их масштабирования.
История 07
Anthropic обещала постоянный доступ внешним оценщикам
12 сентября Дарио Амодей предложил замедлить рост возможностей передовых моделей и объявил первый практический шаг: Anthropic обязуется дать внешним оценщикам постоянный доступ, сопоставимый с доступом сотрудников.
Почему это касается бизнеса
Оценщики должны проверять соблюдение правил безопасности, сообщать об инцидентах и изучать не только готовые модели, но и процессы обучения. Остальные части плана — отраслевые стандарты и международная координация — пока остаются предложениями.
TechCrunch подтверждает публичное обязательство, но не сообщает о завершенном независимом аудите. Реальную силу шага покажут полномочия оценщиков, сроки, публикация результатов и обработка исключений по закону или договорам.
Где это бьет
- обязательство еще нужно превратить в проверяемый режим;
- координация между конкурентами может столкнуться с антимонопольными ограничениями;
- два следующих уровня плана не приняты отраслью или государствами.
Что продавать
Карту доказательств безопасности поставщика: кто проверяет, к чему имеет доступ, что публикует и как фиксируются исключения.
Независимый доступ становится полезным только тогда, когда из него выходят проверяемые результаты.
Что взять из этой недели
Перед подключением нового агента зафиксируйте четыре вещи: какие данные он видит, какие действия может выполнить, где требуется подтверждение человека и каким тестом проверяется результат. Чем шире доступ, тем важнее журнал, минимальные права и возможность быстро остановить процесс.
