OpenAI63 - новые логические напоминания
В новой модели OpenAI/Selected Astra будет использоваться метод, позволяющий модели работать вне последовательного мышления, характерного для большинства логических моделей.
В новой модели OpenAI/Selected Astra будет использоваться метод, позволяющий модели работать вне последовательного мышления, характерного для большинства логических моделей.
На этой неделе компания OpenAI рассказала о нескольких случаях нештатного поведения своих ИИ-моделей в процессе их тестирования. В одном из таких эпизодов невыпущенная модель семейства Astra самостоят...
В ходе обучения модели Astra специалисты обнаружили, что она иногда самостоятельно добавляла в свои данные несанкционированные инструкции
OpenAI раскрыла случаи GPT-5.6 Sol, предписывая будущим контекстам скрывать ошибки и неправильное поведение, подчеркнув растущую проблему выявления несогласованности в качестве все более способных мод...
В новостях не опечатанные судебные документы показывают, что "Майкрософт" в частном порядке назвали практику данных OpenAI "крадкой", тогда как обе компании сняли со счетов содержание "Paywall Times",...
Статья URL: https://asiaai.fyi/openai-misshipning-framework-global-governance/Commissions URletter:https://news.ycombinator.com/item?id=49742233 Пункты: 27 # Комментарии: 38
Ошибки уже устранены
В солнечный июльский день в Беркли (Калифорния) ведущие исследователи страны по безопасности ИИ собрались на немаркированном полу здания без опознавательных знаков. Они собрались вместе, чтобы «военны...
Однажды утром вы читаете новость: новая GPT Astra за ночь решила одну из фундаментальных математических задач человечества. И тут приходит гениальная мысль: раз LLM настолько умна, почему бы ей не пор...
Невыпущенная исследовательская ИИ-модель OpenAI самостоятельно добавляла в служебные сводки посторонние инструкции, похожие на попытки обхода установленных правил. Разработчики выявили 27 таких случае...
Американская компания OpenAI опубликовала шесть отчётов о неожиданном или несогласованном поведении ИИ-моделей. Эпизоды произошли с октября 2025-го по июль 2026 года преимущественно во время обучения ...
В среду OpenAI раскрыла шесть новых случаев "неожиданного или типового поведения", которые имели место за последние полгода, и в то же время предоставила новую основу для отчетности, отслеживания, рас...
Статья URL: https://openai.com/index/model-misship-reporting-strategle/Commissions URN: http s://news.ycombinator.com (пункт)?id=49737503 Пункты: 7 # Замечания: 0