Разработчики больших языковых моделей, такие как OpenAI и Anthropic, всё больше интересуются внутренними корпоративными данными, поскольку сталкиваются с ограничениями при сборе общедоступной информации в интернете для обучения нейросетей. По данным источника, за последние месяцы резко вырос спрос на такие данные, как переписка в мессенджерах, электронные письма, записи видеоконференций и история изменений программного кода.
Источник изображения: Gemini
Гендиректор брокера данных Protege Бобби Сэмюэлс (Bobby Samuels) заявил, что на фоне растущего спроса объём сделок его компании вырос с $30 млн в прошлом году до как минимум $100 млн в нынешнем. Повышенный интерес к данным связан в том числе с развитием ИИ-агентов, способных выполнять реальные повседневные задачи пользователей.
Интерес к корпоративным данным объясняется тем, что записи реального взаимодействия между людьми содержат информацию о том, как разработчики решают проблемы, обсуждают финансовые показатели, демонстрируют работу программного обеспечения и выполняют другие задачи. Всё это может быть полезно при обучении и совершенствовании ИИ-моделей. Покупатели в первую очередь интересуются данными стартапов, которым грозит банкротство или поглощение.