17.08.2026
Для обучения ИИ-агентов компании ищут записи реальных рабочих процессов: переписку, электронные письма, видеоконференции и историю изменений кода. Брокеры данных сообщают о кратном росте сделок, однако продажа таких массивов усиливает риски утечки персональной и конфиденциальной информации.
Разработчики больших языковых моделей, включая OpenAI и Anthropic, всё активнее интересуются внутренними данными компаний. Как сообщает 3DNews, среди востребованных материалов — корпоративные чаты, электронные письма, записи видеоконференций и история изменений программного кода.
Такие данные позволяют обучать ИИ-агентов на примерах реальных рабочих процессов: обсуждении финансовых показателей, поиске ошибок, демонстрации программного обеспечения и совместном решении задач. По словам главы брокера данных Protege Бобби Сэмюэлса, объём сделок компании вырос с $30 млн в 2025 году как минимум до $100 млн в 2026-м.
Особый интерес представляют данные стартапов, которым грозит закрытие или поглощение. Разработчик ИИ-агентов Warmly после заключения соглашения о покупке компанией HubSpot получил четыре предложения стоимостью до $300 тыс. за материалы о работе сотрудников, включая письма и протоколы совещаний. Компания отклонила все предложения.
Рост рынка корпоративных данных повышает требования к их обезличиванию. Перед передачей таких массивов необходимо удалить сведения, позволяющие идентифицировать сотрудников, клиентов и контрагентов, не уничтожив при этом полезный для обучения моделей контекст.
Источник: 3dnews.ru