Google Gemini Layout Parser 1.6
Analisador assistido pelo Gemini do Google Cloud para preservar a hierarquia de documentos e criar blocos ricos em contexto para pesquisa corporativa e RAG.
Analisador assistido pelo Gemini do Google Cloud para preservar a hierarquia de documentos e criar blocos ricos em contexto para pesquisa corporativa e RAG.
Visão geral em inglês simples
Gemini Layout Parser 1.6 combina OCR Google com Gemini 3.0 Flash. Ele identifica títulos, parágrafos, listas, tabelas, figuras, cabeçalhos e rodapés e, em seguida, constrói uma árvore de documentos para que uma passagem recuperada possa manter o contexto da seção de onde veio.
Este é um serviço de análise e agrupamento, em vez de um modelo geral de bate-papo. É especialmente útil quando o OCR simples separa uma tabela de seus cabeçalhos ou um parágrafo de sua seção pai.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Preços e comparações
Defina seu uso. A estimativa é atualizada enquanto você digita.
Conta páginas, não arquivos. Um PDF de 10 páginas conta como 10 páginas. A estimativa usa a tarifa de processamento disponível por modelo.
Google Gemini Layout Parser 1.6
Google Cloud
Total estimado (USD)
Para o uso indicado · USD · Preço de API, não de assinatura
Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.
Acesso à API e ao provedor
Disponibilidade
Acesso de candidato a lançamento por meio do Google Cloud Document AI.
Esta versão usa o endpoint global Vertex AI Gemini e explicitamente não é compatível com o padrão de residência de dados do Google, mesmo quando chamada através de endpoints dos EUA ou da UE.
Verifique a disponibilidade ao vivoDados e treinamento
Google afirma que os documentos e previsões dos clientes do Document AI não são usados para treinar seus modelos. Os documentos online são processados na memória sem persistência em disco; entradas em lote têm uma retenção à prova de falhas de até um dia.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
Analisador assistido pelo Gemini do Google Cloud para preservar a hierarquia de documentos e criar blocos ricos em contexto para pesquisa corporativa e RAG. Gemini Layout Parser 1.6 combina OCR Google com Gemini 3.0 Flash. Ele identifica títulos, parágrafos, listas, tabelas, figuras, cabeçalhos e rodapés e, em seguida, constrói uma árvore de documentos para que uma passagem recuperada possa manter o contexto da seção de onde veio.
Google Gemini Layout Parser 1.6 foi lançado em 13 de janeiro de 2026 de acordo com os materiais do fornecedor citado.
Acesso de candidato a lançamento por meio do Google Cloud Document AI. As rotas de acesso listadas neste guia são Google Cloud.
US$ 10/1.000 páginas. O preço do analisador de layout do Google Cloud inclui a fragmentação inicial. O reagrupamento é cobrado separadamente.
Acesso de candidato a lançamento por meio do Google Cloud Document AI. Esta versão usa o endpoint global Vertex AI Gemini e explicitamente não é compatível com o padrão de residência de dados do Google, mesmo quando chamada através de endpoints dos EUA ou da UE.
Google afirma que os documentos e previsões dos clientes do Document AI não são usados para treinar seus modelos. Os documentos online são processados na memória sem persistência em disco; entradas em lote têm uma retenção à prova de falhas de até um dia. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
Comparações relacionadas
Analisador de documentos compacto do Cohere para transformar PDFs, apresentações e digitalizações empresariais em Markdown prontos para recuperação e metadados de layout.
Abrir comparação completaO atual modelo Document AI OCR da Mistral para preservar a ordem de leitura, tabelas, estrutura, locais e confiança em arquivos multilíngues.
Abrir comparação completaProcessador Document AI do Google Cloud com tecnologia Gemini para extrair os campos exatos e valores derivados definidos em um esquema de negócios.
Abrir comparação completa