Mistral AI revela ferramenta que transformará qualquer documento PDF em arquivo de texto para IA

A desenvolvedora de modelos de grandes linguagens (LLM) franceses, Mistral AI, anunciou o lançamento de uma nova API projetada para lidar com documentos PDF complexos. Mistral OCR é uma API de reconhecimento óptico de caracteres (OCR) que pode transformar qualquer documento PDF em um arquivo de texto para facilitar o processamento com algoritmos baseados em IA.

Fonte da imagem: Scott Graham / Unsplash

Os modelos de linguagem que impulsionam algoritmos generativos populares, como o ChatGPT da OpenAI, funcionam particularmente bem em texto bruto. Portanto, as empresas que pretendem introduzir seus próprios fluxos de trabalho de IA sabem da importância de armazenar e indexar os dados em um formato limpo para que essas informações possam ser reutilizadas no processamento dos algoritmos de IA.

Ao contrário de muitas APIs de OCR, o desenvolvimento da Mistral é uma API multimodal que pode reconhecer não apenas texto, mas também ilustrações e fotografias colocadas entre blocos de texto. A API OCR gera caixas delimitadoras em torno dos elementos gráficos detectados e os inclui na saída. Processar um documento PDF com o Mistral OCR resulta em texto formatado em Markdown, que os algoritmos de IA processam com mais eficiência.

Fonte da imagem: Mistral

«Ao longo dos anos, as organizações acumulam um grande número de documentos, geralmente em formato PDF ou slide, que não são acessíveis para processamento LLM, especialmente para sistemas RAG [Retrieval-Augmented Generation – uma técnica para obter e usar dados como contexto para algoritmos de IA generativa]. Com o Mistral OCR, nossos clientes podem transformar documentos complexos em conteúdo legível em todos os idiomas. “Este é um passo fundamental para a adoção generalizada de assistentes de IA em empresas que precisam simplificar o acesso a uma extensa documentação interna”, disse Guillaume Lample, cofundador e diretor científico da Mistral.

O Mistral OCR está disponível na plataforma própria da empresa, bem como na infraestrutura dos parceiros de nuvem da Mistral, como AWS, Azure, etc. Para empresas que trabalham com dados confidenciais ou sigilosos, a Mistral oferece uma versão de API para implantação local. A empresa disse que o Mistral OCR tem melhor desempenho do que APIs semelhantes do Google, Microsoft ou OpenAI. A empresa testou sua API em documentos PDF complexos, incluindo aqueles contendo expressões matemáticas, layouts complexos e tabelas.

avalanche

Postagens recentes

A estratégia europeia para o setor de semicondutores fracassou: os investimentos estagnaram e a dependência aumentou.

A União Europeia esperava reduzir sua dependência dos EUA e da China em relação aos…

20 minutos atrás

O novo chefe da NASA promete levar americanos de volta à Lua antes do fim do mandato de Trump.

Em 2019, o programa lunar da NASA foi renomeado para "Artemis" e o objetivo era…

32 minutos atrás

Cientistas reduziram o menor robô com cérebro em 10.000 vezes — agora ele tem o tamanho de um grão de sal.

Cientistas da Universidade da Pensilvânia (Penn) e da Universidade de Michigan (UMich) criaram o menor…

42 minutos atrás

Elon Musk finalmente desistiu da missão ambiental da Tesla.

Como a Tesla é uma empresa de capital aberto e o preço de suas ações…

5 horas atrás

O presidente da Wingtech, empresa chinesa, manifestou o desejo de retomar o controle da Nexperia, empresa que foi apreendida pelos Países Baixos.

Os problemas da indústria automotiva neste ano foram agravados pela situação em torno da empresa…

5 horas atrás

A Huawei pretende fornecer seus aceleradores de IA para a Coreia do Sul.

A prioridade atual da Huawei é a substituição de importações na indústria chinesa de IA,…

6 horas atrás