Назад в блог

CHI AI Trendwatch

AI-неделя: агенты получили доступ к приложениям, данным и внешнему миру

Семь историй о новых агентах, визуальной работе, корпоративных данных, науке и цене доверия.

7 историй7–13 сентябрябизнес, продукт и создателиRU / EN / TR

На этой неделе AI-системы двигались от ответа к действию. Meta дала персональному агенту доступ к приложениям, OpenAI связала агентов с корпоративными данными и длительными процессами, а визуальный редактор получил более точные способы управления.

Вместе с доступом выросла цена ошибки. Поэтому в выпуске отдельно отмечены права, резидентность данных, отсутствие независимых бенчмарков, статус прогнозов и разница между публичным обещанием и завершенной проверкой.

История 01

Meta выпустила агента Muse с доступом к приложениям

8 сентября Meta начала выпуск Muse в США на iOS, Android, muse.ai и в WhatsApp. Агент может работать с почтой, календарями, платежами и браузером, продолжать длинные задачи в фоне и запрашивать подтверждение перед чувствительными действиями.

Почему это касается бизнеса

Muse работает в отдельной облачной виртуальной машине. Отдельный Sentinel контролирует коннекторы и сетевой трафик, а реальные пароли и платежные данные, по заявлению Meta, не показываются основной модели.

Reuters сообщает, что внутренние тесты выявляли зависания и несанкционированное раскрытие чувствительных данных. Meta прямо признает, что агент ошибается; Confidential VM, которая должна технически закрыть доступ Meta к данным, обещана позднее в этом году.

Где это бьет

  • запуск ограничен США и идет постепенно;
  • агент получает широкий контекст из личных и рабочих сервисов;
  • нынешняя Secure VM не исключает технический доступ Meta к данным.

Что продавать

Аудит допуска персонального агента: перечень подключений, минимальные права, сценарии обязательного подтверждения и журнал действий.

ПродюсеруНе поручайте Muse отправку или покупку без заранее заданной точки человеческого подтверждения.
МаркетологуПодключайте отдельный тестовый календарь или почтовый ящик, прежде чем давать доступ к рабочей переписке.
ПредпринимателюПроверьте договорные требования к данным: потребительский продукт не равен корпоративной среде с DPA.
ЭкспертуДля личных задач начните с чтения и планирования, а права на запись выдавайте после проверки журнала.
У агента появился доступ к приложениям. Главный вопрос теперь — какие действия ему действительно разрешены.

История 02

ChatGPT Images 2.5 получил эскизы и точечные правки

8 сентября OpenAI начала rollout ChatGPT Images 2.5 для всех тарифов ChatGPT, ChatGPT Work и Codex. В интерфейсе появились Sketch, комментарии прямо на изображении, шаблоны и передача промпта вместе с картинкой.

Почему это касается бизнеса

OpenAI заявляет о более точном сохранении объектов и последовательности правок, а также о снижении задержки до 50% по сравнению с Images 2.0. Для API выпущены Flare и более медленный Sunburst.

The Verge в коротком тесте подтвердил работу эскиза и локального изменения цвета глаз. Это ранняя демонстрация, а не независимый сравнительный бенчмарк качества.

Где это бьет

  • цифра до 50% — измерение OpenAI;
  • многошаговая правка все еще требует проверки каждой версии;
  • C2PA и невидимая маркировка помогают с происхождением, но не заменяют редакционный контроль.

Что продавать

Спринт визуальных вариантов: эскиз композиции, три версии, список неизменяемых элементов и финальная проверка текста и бренда.

ПродюсеруЗафиксируйте исходный эскиз и перечень элементов, которые нельзя менять между версиями.
МаркетологуИспользуйте комментарии для локальных правок, но вычитывайте весь макет после каждого прохода.
ПредпринимателюСравните время до принятого макета, а не только скорость одной генерации.
ЭкспертуПри работе с лицами и товарами храните исходный референс и согласование финального изображения.
Эскиз сокращает путь до варианта. Готовность к публикации по-прежнему определяется проверкой.

История 03

Data agent строит дашборды из корпоративных источников

10 сентября OpenAI представила Data agent в ChatGPT Work. Он подключается к одобренным источникам данных, исследует изменения, строит интерактивные дашборды и может выполнить подтвержденные действия через связанные инструменты.

Почему это касается бизнеса

Список интеграций включает Redshift, BigQuery, Databricks, Snowflake, MongoDB, Datadog, Google Drive и SharePoint. Администраторы выбирают подключения и роли, а запросы наследуют ограничения таблиц, строк и столбцов.

VentureBeat отмечает главное доказательное ограничение запуска: OpenAI не опубликовала внешний бенчмарк точности поиска или выводов для продукта. Доступ к данным и красивый дашборд сами по себе не подтверждают правильность метрик.

Где это бьет

  • ошибка в определении метрики масштабируется в рекомендации и действия;
  • качество зависит от семантического слоя и прав доступа;
  • внешняя точность продукта пока не измерена публично.

Что продавать

Пилот Data agent на трех управленческих вопросах: словарь метрик, эталонные ответы, проверка источников и журнал подтвержденных действий.

ПродюсеруЗаранее определите, кто подтверждает вывод и кто разрешает последующее действие.
МаркетологуНачните с отчета, где известны контрольные цифры и причины прошлых изменений.
ПредпринимателюНе открывайте больше источников, чем требуется для конкретного управленческого вопроса.
ЭкспертуПоказывайте рядом с выводом определение метрики, период и исходную таблицу.
Разговорный интерфейс упрощает запрос. Он не отменяет определения метрик и сверку с источником.

История 04

AlphaGenome Atlas нанес на карту 9 млрд вариантов ДНК

8 сентября Google DeepMind открыла AlphaGenome Atlas: базу прогнозов для 9 млрд возможных однонуклеотидных изменений человеческого генома. Объем набора составляет около 1 петабайта; веб-портал доступен для некоммерческих исследований.

Почему это касается бизнеса

Atlas заранее рассчитывает возможное влияние вариантов и присваивает им AVI score, чтобы исследователи могли быстрее выбирать кандидатов для проверки. Google приводит результаты на данных 54 000+ участников UK Biobank и пример редкого варианта DNM1.

Nature подчеркивает, что это прогнозная карта. Она помогает расставить приоритеты, но не доказывает причинность и не заменяет лабораторную или клиническую валидацию; коммерческий доступ требует отдельной лицензии.

Где это бьет

  • модельный балл легко принять за медицинский вывод;
  • одиночные изменения не описывают все комбинации и типы вариантов;
  • для коммерческого использования нужны условия Google Cloud.

Что продавать

Разбор AI-научного инструмента для команды: область применимости, цепочка доказательств, лицензия и план экспериментальной проверки.

ПродюсеруВ научном проекте отделите этап поиска кандидатов от этапа подтверждения результата.
МаркетологуНе переводите исследовательскую точность в рекламное обещание о диагностике.
ПредпринимателюДо коммерческого пилота уточните лицензию, хранение геномных данных и ответственность.
ЭкспертуОбъясняйте AVI score как сигнал для приоритизации, а не как готовый диагноз.
Девять миллиардов прогнозов ускоряют поиск. Доказательство начинается после прогноза.

История 05

OpenAI открыла Agents API в публичной бете

10 сентября OpenAI открыла всем разработчикам публичную бету Agents API — управляемую оболочку Codex для длительных агентных задач. Она берет на себя сессии, оркестрацию, сжатие контекста и восстановление.

Почему это касается бизнеса

Команда может выбрать песочницу OpenAI, собственную инфраструктуру или партнера; агент умеет выполнять код, работать с файлами, MCP-инструментами и подагентами. Отдельной платы за API нет, но оплачиваются модели, инструменты и контейнеры.

Документация фиксирует существенное ограничение беты: только резидентность данных в США и отсутствие Zero Data Retention. Собственная песочница это ограничение не снимает.

Где это бьет

  • интерфейс публичной беты может меняться;
  • стоимость складывается из токенов, инструментов и среды исполнения;
  • US-only residency и отсутствие ZDR блокируют часть регулируемых сценариев.

Что продавать

Предпроизводственный агентный контур: один ограниченный процесс, бюджет, максимальное число подагентов, журнал инструментов и тест восстановления.

ПродюсеруОграничьте число параллельных подагентов и критерий завершения до первого рабочего прогона.
МаркетологуНе подключайте клиентские каналы, пока не проверены разрешения и журнал каждого инструмента.
ПредпринимателюСверьте резидентность и хранение данных до выбора между управляемой и собственной песочницей.
ЭкспертуДайте агенту эталонный результат и измеряйте не только завершение, но и число ручных исправлений.
Управляемая оболочка убирает часть инфраструктуры. Контроль данных, бюджета и действий остается у команды.

История 06

Anthropic описала 7 типов злоупотреблений Claude

10 сентября Anthropic опубликовала отчет об операциях, выявленных и остановленных с декабря 2025-го по август 2026-го. В нем 7 направлений вреда: кибероперации, влияние, слежка, мошенничество, биологические риски, оружие и дистилляция моделей.

Почему это касается бизнеса

По данным Anthropic, злоумышленники переходят от вопросов к оркестрации разведки, эксплуатации и вывода данных через многоагентные схемы. В одном описанном российском сценарии планирование затронуло более 20 организаций.

Reuters независимо разобрал заявленные случаи, но первичные атрибуции и оценка вклада AI принадлежат Anthropic. Компания подчеркивает, что это заметные и новые случаи, а не типичное использование Claude.

Где это бьет

  • обычные украденные ключи и фишинг получают более быстрый исполнительный слой;
  • статическая защита хуже работает против постоянно перестраиваемых инструментов;
  • отчет провайдера не равен независимому расследованию каждого эпизода.

Что продавать

Учение по AI-ускоренной атаке: украденный ключ, фишинг, автономное повторение действий, отзыв доступа и проверка журналов.

ПродюсеруДобавьте остановку процесса и отзыв токенов в сценарий любого агента с внешними действиями.
МаркетологуПредупредите команду о поддельных AI-сервисах и запросах на API-ключи.
ПредпринимателюПроверьте, видит ли мониторинг повторные попытки из разных учетных записей и сервисов.
ЭкспертуНе загружайте секреты в непроверенный AI-прокси даже ради более низкой цены.
AI не отменил старые атаки. Он сокращает время и число людей, нужных для их масштабирования.

История 07

Anthropic обещала постоянный доступ внешним оценщикам

12 сентября Дарио Амодей предложил замедлить рост возможностей передовых моделей и объявил первый практический шаг: Anthropic обязуется дать внешним оценщикам постоянный доступ, сопоставимый с доступом сотрудников.

Почему это касается бизнеса

Оценщики должны проверять соблюдение правил безопасности, сообщать об инцидентах и изучать не только готовые модели, но и процессы обучения. Остальные части плана — отраслевые стандарты и международная координация — пока остаются предложениями.

TechCrunch подтверждает публичное обязательство, но не сообщает о завершенном независимом аудите. Реальную силу шага покажут полномочия оценщиков, сроки, публикация результатов и обработка исключений по закону или договорам.

Где это бьет

  • обязательство еще нужно превратить в проверяемый режим;
  • координация между конкурентами может столкнуться с антимонопольными ограничениями;
  • два следующих уровня плана не приняты отраслью или государствами.

Что продавать

Карту доказательств безопасности поставщика: кто проверяет, к чему имеет доступ, что публикует и как фиксируются исключения.

ПродюсеруПри выборе модели спрашивайте не только о тестах, но и о независимом доступе к инцидентам.
МаркетологуНе превращайте заявление о безопасности в рекламный факт до появления отчета оценщика.
ПредпринимателюВ закупке закрепите уведомление об инцидентах и право пересмотреть использование сервиса.
ЭкспертуРазделяйте публичное обязательство, действующий процесс и опубликованный результат проверки.
Независимый доступ становится полезным только тогда, когда из него выходят проверяемые результаты.

Что взять из этой недели

Перед подключением нового агента зафиксируйте четыре вещи: какие данные он видит, какие действия может выполнить, где требуется подтверждение человека и каким тестом проверяется результат. Чем шире доступ, тем важнее журнал, минимальные права и возможность быстро остановить процесс.