
A Mistral anunciou o lançamento do Mistral OCR 4, uma nova ferramenta de processamento de documentos que introduz capacidades avançadas de localização e classificação de conteúdos, além de expandir de forma considerável o suporte linguístico da plataforma. De acordo com a publicação oficial da Mistral, o modelo foca-se na extração estruturada de informação a partir de ficheiros complexos, otimizando o fluxo de trabalho empresarial. O preço para o mercado português e europeu ainda não foi detalhado de forma isolada, uma vez que a solução é disponibilizada através de pacotes de computação em nuvem e APIs específicas.
Estrutura de dados e suporte linguístico
O novo modelo traz melhorias no reconhecimento visual de documentos. Cada bloco de conteúdo extraído passa a ser localizado com caixas delimitadoras e classificado de acordo com a sua tipologia. O sistema fornece métricas de confiança por página e por palavra ao longo do documento textual gerado, garantindo uma maior validação dos dados processados.

A compatibilidade estende-se agora a 170 idiomas, distribuídos por dez grupos linguísticos, abrangendo línguas de poucos recursos que costumam ser ignoradas pelas grandes soluções tecnológicas atuais. Para quem trabalha em ambientes corporativos, isto significa maior flexibilidade, pois a solução aceita nativamente formatos empresariais muito populares, como PDF, DOC, PPT e OpenDocument.
Implementação local e integração em sistemas
Para as organizações que priorizam a soberania da informação, o Mistral OCR 4 corre através de um único contentor, permitindo o alojamento local completo nas infraestruturas da própria empresa. Esta abordagem ajuda a controlar os custos operacionais em cenários de processamento de alto volume, eliminando a dependência constante de servidores externos.
O modelo atua tanto na extração básica de texto como em fluxos mais complexos, servindo de componente de ingestão para sistemas de pesquisa empresarial e arquiteturas baseadas em RAG (geração aumentada por recuperação). O acesso já se encontra disponível por API no Mistral Studio, Amazon SageMaker e Microsoft Foundry, estando também prevista para breve a integração com o Snowflake Parse Document.












Nenhum comentário
Seja o primeiro!