Mistral AI revela ferramenta que transformará qualquer documento PDF em arquivo de texto para IA

A desenvolvedora de modelos de grandes linguagens (LLM) franceses, Mistral AI, anunciou o lançamento de uma nova API projetada para lidar com documentos PDF complexos. Mistral OCR é uma API de reconhecimento óptico de caracteres (OCR) que pode transformar qualquer documento PDF em um arquivo de texto para facilitar o processamento com algoritmos baseados em IA.

Fonte da imagem: Scott Graham / Unsplash

Os modelos de linguagem que impulsionam algoritmos generativos populares, como o ChatGPT da OpenAI, funcionam particularmente bem em texto bruto. Portanto, as empresas que pretendem introduzir seus próprios fluxos de trabalho de IA sabem da importância de armazenar e indexar os dados em um formato limpo para que essas informações possam ser reutilizadas no processamento dos algoritmos de IA.

Ao contrário de muitas APIs de OCR, o desenvolvimento da Mistral é uma API multimodal que pode reconhecer não apenas texto, mas também ilustrações e fotografias colocadas entre blocos de texto. A API OCR gera caixas delimitadoras em torno dos elementos gráficos detectados e os inclui na saída. Processar um documento PDF com o Mistral OCR resulta em texto formatado em Markdown, que os algoritmos de IA processam com mais eficiência.

Fonte da imagem: Mistral

«Ao longo dos anos, as organizações acumulam um grande número de documentos, geralmente em formato PDF ou slide, que não são acessíveis para processamento LLM, especialmente para sistemas RAG [Retrieval-Augmented Generation – uma técnica para obter e usar dados como contexto para algoritmos de IA generativa]. Com o Mistral OCR, nossos clientes podem transformar documentos complexos em conteúdo legível em todos os idiomas. “Este é um passo fundamental para a adoção generalizada de assistentes de IA em empresas que precisam simplificar o acesso a uma extensa documentação interna”, disse Guillaume Lample, cofundador e diretor científico da Mistral.

O Mistral OCR está disponível na plataforma própria da empresa, bem como na infraestrutura dos parceiros de nuvem da Mistral, como AWS, Azure, etc. Para empresas que trabalham com dados confidenciais ou sigilosos, a Mistral oferece uma versão de API para implantação local. A empresa disse que o Mistral OCR tem melhor desempenho do que APIs semelhantes do Google, Microsoft ou OpenAI. A empresa testou sua API em documentos PDF complexos, incluindo aqueles contendo expressões matemáticas, layouts complexos e tabelas.

avalanche

Postagens recentes

Hackers atacam Jaguar Land Rover – Produção de carros interrompida

A Jaguar Land Rover (JLR) afirmou que a violação "interrompeu gravemente" suas operações de varejo…

19 minutos atrás

EUA impediram a TSMC de fornecer equipamentos para sua fábrica de chips na China

Os Estados Unidos revogaram a permissão da Taiwan Semiconductor Manufacturing Co. de fornecer livremente equipamentos…

19 minutos atrás

Tesla não inicia vendas na Índia – apenas 600 pedidos em 2,5 meses

A tão aguardada entrada da Tesla no mercado indiano ficou aquém das expectativas até agora,…

1 hora atrás

Dolby Vision 2 apresentado – HDR “cinematográfico”, anti-aliasing autêntico e otimizações de IA

Dez anos após o lançamento do formato Dolby Vision, uma versão atualizada do padrão, o…

1 hora atrás

Os computadores quânticos ainda não estão prontos, mas milhões já estão sendo investidos em software para eles

Durante décadas, os esforços dos desenvolvedores de computação quântica se concentraram principalmente na criação de…

1 hora atrás