Hook

Their other posts in the index, biggest breakout first.
Китай только что выпустил в открытый доступ крошечную модель ИИ для оптического распознавания символов. ИИ для оптического распознавания символов, которая обрабатывает целые ПДФ файлы на 100 страниц за один раз. Она называется Unlimited OCR, имеет 3 миллиарда параметров и разработана Байду, которую называют китайским Гугл. В то время как любой другой OCR разбивает ваш документ на страницы и теряет контекст, эта модель читает весь документ за 1 проход. Итак, вот что это на самом деле означает для вас: Загрузите 40 страничный контракт, и он выдаст структурированный текст с заголовком и пунктом точно на своём месте. Вы даже можете загрузить в него отсканированный финансовый отчёт, и он сохранит формулы, порядок чтения и не требуя от вас никаких действий. Если вы создаете конвейер или инструмент для поиска документов, вам не нужен сложный стек предварительной обработки ПДФ файлов. И самое лучшее, что он полностью работает на вашей локальной машине, поэтому ваши документы никогда не покидают вашу систему. Он имеет лицензию MIT и бесплатен для коммерческого использования. Итак, хотите попробовать? Ссылка находится в закреплённых комментариях.