Mistral AI revela ferramenta que transformará qualquer documento PDF em arquivo de texto para IA

A desenvolvedora de modelos de grandes linguagens (LLM) franceses, Mistral AI, anunciou o lançamento de uma nova API projetada para lidar com documentos PDF complexos. Mistral OCR é uma API de reconhecimento óptico de caracteres (OCR) que pode transformar qualquer documento PDF em um arquivo de texto para facilitar o processamento com algoritmos baseados em IA.

Fonte da imagem: Scott Graham / Unsplash

Os modelos de linguagem que impulsionam algoritmos generativos populares, como o ChatGPT da OpenAI, funcionam particularmente bem em texto bruto. Portanto, as empresas que pretendem introduzir seus próprios fluxos de trabalho de IA sabem da importância de armazenar e indexar os dados em um formato limpo para que essas informações possam ser reutilizadas no processamento dos algoritmos de IA.

Ao contrário de muitas APIs de OCR, o desenvolvimento da Mistral é uma API multimodal que pode reconhecer não apenas texto, mas também ilustrações e fotografias colocadas entre blocos de texto. A API OCR gera caixas delimitadoras em torno dos elementos gráficos detectados e os inclui na saída. Processar um documento PDF com o Mistral OCR resulta em texto formatado em Markdown, que os algoritmos de IA processam com mais eficiência.

Fonte da imagem: Mistral

«Ao longo dos anos, as organizações acumulam um grande número de documentos, geralmente em formato PDF ou slide, que não são acessíveis para processamento LLM, especialmente para sistemas RAG [Retrieval-Augmented Generation – uma técnica para obter e usar dados como contexto para algoritmos de IA generativa]. Com o Mistral OCR, nossos clientes podem transformar documentos complexos em conteúdo legível em todos os idiomas. “Este é um passo fundamental para a adoção generalizada de assistentes de IA em empresas que precisam simplificar o acesso a uma extensa documentação interna”, disse Guillaume Lample, cofundador e diretor científico da Mistral.

O Mistral OCR está disponível na plataforma própria da empresa, bem como na infraestrutura dos parceiros de nuvem da Mistral, como AWS, Azure, etc. Para empresas que trabalham com dados confidenciais ou sigilosos, a Mistral oferece uma versão de API para implantação local. A empresa disse que o Mistral OCR tem melhor desempenho do que APIs semelhantes do Google, Microsoft ou OpenAI. A empresa testou sua API em documentos PDF complexos, incluindo aqueles contendo expressões matemáticas, layouts complexos e tabelas.

avalanche

Postagens recentes

A Microsoft corrigiu uma vulnerabilidade no Bloco de Notas que permitia a execução de código malicioso no Windows 11.

Uma vulnerabilidade foi descoberta no aplicativo Bloco de Notas do Windows 11 que permitia a…

29 minutos atrás

A Apple lançou o iOS 26.3, trazendo a transferência de dados sem fio para o Android, uma nova galeria e outras melhorias.

A Apple começou a liberar o iOS 26.3, a terceira grande atualização do sistema operacional…

40 minutos atrás

A Apple lançou atualizações para versões antigas do iOS, macOS e iPadOS.

A Apple lançou diversas atualizações para suas plataformas de software utilizadas em dispositivos de várias…

40 minutos atrás

A Microsoft corrigiu um bug do Windows 11 que fazia com que os PCs fossem ativados e perdessem a energia da bateria.

A Microsoft anunciou que os processos em segundo plano no Windows 11 não causam mais…

2 horas atrás

A AMD lançou um driver com suporte para Yakuza Kiwami 3 e Nioh 3.

A AMD lançou a versão mais recente do driver gráfico Radeon Software Adrenalin 26.2.1 WHQL.…

2 horas atrás

A HP agora oferece laptops para jogos por meio de assinatura, a partir de US$ 50 por mês, sem opção de compra definitiva.

A HP vem desenvolvendo discretamente um serviço de aluguel de notebooks e acessórios para jogos…

2 horas atrás