Команда Azure AI начала в блоге Microsoft Foundry серию статей об извлечении контента (Why content extraction still matters in the GenAI era).
Повод: Microsoft вернулась к разбору PDF
Главный тезис авторов: успех корпоративного ИИ зависит от того, может ли агент доверять контенту, с которым работает.
По их оценке, выбор модели влияет на результат меньше
Я с этим согласен и добавлю из опыта интегратора: в AI-проекте больше всего работы уходит на разбор PDF, сканов и выгрузок поставщиков.
На этом этапе проект либо даёт результат, либо тихо закрывается.


