Тест SWE: Контроль уязвимости ЛММ с помощью прогноза входных данных
arXiv: 2609.06229v1 Анонс Тип: перекрестное резюме: Обнаружение уязвимости становится важной способностью крупных языковых моделей (LLM) агентов, которые молчаливо пропускают реальные дефекты, оставляют критическую программу открытой. Поэтому настоятельно необходимо тщательно измерять эту…