Mistral AI revela ferramenta que transformará qualquer documento PDF em arquivo de texto para IA

A desenvolvedora de modelos de grandes linguagens (LLM) franceses, Mistral AI, anunciou o lançamento de uma nova API projetada para lidar com documentos PDF complexos. Mistral OCR é uma API de reconhecimento óptico de caracteres (OCR) que pode transformar qualquer documento PDF em um arquivo de texto para facilitar o processamento com algoritmos baseados em IA.

Fonte da imagem: Scott Graham / Unsplash

Os modelos de linguagem que impulsionam algoritmos generativos populares, como o ChatGPT da OpenAI, funcionam particularmente bem em texto bruto. Portanto, as empresas que pretendem introduzir seus próprios fluxos de trabalho de IA sabem da importância de armazenar e indexar os dados em um formato limpo para que essas informações possam ser reutilizadas no processamento dos algoritmos de IA.

Ao contrário de muitas APIs de OCR, o desenvolvimento da Mistral é uma API multimodal que pode reconhecer não apenas texto, mas também ilustrações e fotografias colocadas entre blocos de texto. A API OCR gera caixas delimitadoras em torno dos elementos gráficos detectados e os inclui na saída. Processar um documento PDF com o Mistral OCR resulta em texto formatado em Markdown, que os algoritmos de IA processam com mais eficiência.

Fonte da imagem: Mistral

«Ao longo dos anos, as organizações acumulam um grande número de documentos, geralmente em formato PDF ou slide, que não são acessíveis para processamento LLM, especialmente para sistemas RAG [Retrieval-Augmented Generation – uma técnica para obter e usar dados como contexto para algoritmos de IA generativa]. Com o Mistral OCR, nossos clientes podem transformar documentos complexos em conteúdo legível em todos os idiomas. “Este é um passo fundamental para a adoção generalizada de assistentes de IA em empresas que precisam simplificar o acesso a uma extensa documentação interna”, disse Guillaume Lample, cofundador e diretor científico da Mistral.

O Mistral OCR está disponível na plataforma própria da empresa, bem como na infraestrutura dos parceiros de nuvem da Mistral, como AWS, Azure, etc. Para empresas que trabalham com dados confidenciais ou sigilosos, a Mistral oferece uma versão de API para implantação local. A empresa disse que o Mistral OCR tem melhor desempenho do que APIs semelhantes do Google, Microsoft ou OpenAI. A empresa testou sua API em documentos PDF complexos, incluindo aqueles contendo expressões matemáticas, layouts complexos e tabelas.

avalanche

Postagens recentes

Uma atualização recente do Windows 11 reduziu o desempenho das placas gráficas Nvidia GeForce.

Este mês, a Microsoft lançou mais uma atualização para o Windows 11, que se mostrou…

1 hora atrás

O “TikTok de IA” da OpenAI viralizou após seu lançamento, mas o interesse diminuiu rapidamente — talvez propositalmente.

Após seu lançamento no final de setembro de 2025, o aplicativo de geração de vídeo…

2 horas atrás

A Tesla já opera cerca de 1.000 robôs humanoides Optimus em suas instalações.

A falta de demonstrações públicas dos robôs humanoides Optimus da Tesla nos últimos meses não…

7 horas atrás

A Micron comprará a fábrica de memória de sua rival taiwanesa por US$ 1,8 bilhão.

Esta semana, a empresa americana Micron Technology deixou claro que a expansão da produção de…

8 horas atrás

Patologia 3: A cura para a morte é a saudade. Resenha

Processador Intel Core i3-12100F 3.3 GHz / AMD Ryzen 5 5600X 3.7 GHz, 8 GB…

15 horas atrás