Что, если нужную книгу больше не нужно искать — её можно собрать под собственный вопрос? Я проверил эту идею на реальном корпусе: 206 длинных видео, 160 часов 56 минут и 2,15 млн слов транскриптов . Вместо сотен summary я построил конвейер, который выделяет сущности, схлопывает дубли, отслеживает происхождение выводов, проверяет важные утверждения и понимает, когда оставшиеся источники уже не нужно читать подряд. По ходу выяснилось, почему 9 URL могут оказаться одним источником , почему векторная кластеризация не решила задачу смысловых дублей, чем такой подход отличается от RAG и почему длинная работа ИИ-агента неожиданно начинает напоминать разработку обычной программной системы. Но главный вывод оказался шире самого проекта: единицей работы с информацией может становиться не источник, а наш вопрос. Читать далее
Эдуард Ланчев · «Ланчев PRO ИИ»
В разработке мы давно отделили данные от интерфейса. Теперь то же самое начинает происходить со знаниями. И в этой статье я покажу это на своём примере.
Видео больше не обязано оставаться видео. Подкаст — подкастом. Десятки книг и сотни публикаций — десятками независимых последовательностей, которые человек должен пройти от начала до конца. Современные AI-агенты позволяют сначала собрать и нормализовать источники, затем построить из них проверяемую модель знаний — и уже после этого выбрать форму: книгу, таблицу, аудио, бриф или поисковый интерфейс.
Чтобы проверить, насколько это работает за пределами красивого демо, я построил такой конвейер на реальном корпусе: 206 длинных видео, 160 часов 56 минут, 2,15 млн слов. В процессе пришлось решать вполне инженерные задачи — приоритизацию, дедупликацию, прослеживаемость происхождения выводов, проверку фактов, сохранение состояния, регрессии агента и критерий, по которому можно перестать читать оставшиеся источники.
Похожие статьи
Readovka
Readovka
Любовь американских военных к спорту помогла Ирану обнаружить базы США на Ближнем Востоке
Любовь американских военных к спорту помогла Ирану обнаружить базы США на Ближнем Востоке Иран мог использовать данные фитнес-приложения Strava для отслеживания американских военнослужащих на военных ...
DeepSeek представила платформу Harness для создания из ИИ-моделей автономных агентов
Китайская компания DeepSeek выпустила превью программной платформы Harness, которая позволяет разработчикам превращать ИИ-модели в автономных ИИ-агентов. Её каждый основной элемент поставляется в виде...
NYT раскрыла, как бум ИИ вызвал «цунами разрушений» в нацбезопасности США
Пентагон оказался перед дилеммой, поскольку развитие ИИ в США требует внедрения новых моделей, но ограничения со стороны разработчиков и противоречивые решения властей мешают военным использовать их в...
Смерть среднестатистического разработчика в 2026‑м: почему и что убивает AI
В 2024 году мы боялись, что ChatGPT заменит нас, и мы не будем больше перекрашивать кнопки и писать очередной CRUD. Но оказалось всё прозаичнее — ChatGPT, увы, не заменил нас, но постепенно нужда в ра...
Китайская SMIC повысила цены на производство чипов из-за спроса на ИИ
Крупнейший китайский контрактный производитель чипов SMIC повысил цены на наиболее востребованные производственные мощности на фоне роста спроса со стороны индустрии искусственного интеллекта (ИИ). Бо...
Мониторы тоже подорожают? Уже второй производитель предупредил о росте цен из-за дорогих комплектующих
Китайский производитель мониторов KTC предупредил о скором повышении цен на свою продукцию. Компания объясняет это ростом стоимости основных компонентов и заявляет, что больше не может полностью компе...