OpenAI сообщает о 6 новых случаях "поведение модели" с марта

#OpenAI #CNBC Top Stories #CNBC

OpenAI раскрыла шесть новых случаев ненадлежащего поведения модели и предложила рамки для раскрытия будущих примеров, поскольку дискуссия по поводу модели безопасности АИ активизируется.

OpenAI в среду сказала, что она обнаружила шесть примеров «неожиданного или относительно модели поведения» за последние полгода, помимо недавнего кризиса Хаггинга Лиса, так как компания продолжает призывать к усилению защиты безопасности при разработке искусственных моделей интеллекта. В блоге OpenAI описала новые рамки, которым компания планирует следовать для сообщения о нарушениях модели в будущем. Разглашение информации происходит в период усиления давления на компании АИ, с тем чтобы они более серьезно относились к несогласованности моделей и безопасности. OpenAI, стоимость которой составляет около 1 трлн. долл. Под согласованием понимается идея о том, что модели добиваются результатов в соответствии с человеческими интересами. В субботу генеральный директор OpenAI Сэм Альтман одобрил призыв замедлить темпы прогресса в модели, который был предложен главным соперником компании Антропиком. Это предложение было выдвинуто после того, как несколько исследователей из промышленности выразили тревогу по поводу растущего потенциала МА на прошлой неделе причинить катастрофический ущерб. Альтман сказал в статье на X, что замедление является «первичной темой дискуссий, которые мы провели в OpenAI за последние недели». Он заявил, что компании будет больше делить "скоро". В среду пост OpendaI отметил два основных случая неправильного поведения включают модели — невыпущенную исследовательскую модель и учебный цикл GPT-5.6 Sol: включение инструкций для будущих вариантов в свои окна…