Contextual Retrieval
Aprende como a recuperação contextual melhora o RAG com blocos cientes dos documentos, pesquisa híbrida e reordenação — e explora o Ultralytics YOLO26 para contexto visual multimodal.
A recuperação contextual é uma técnica de pré-processamento que melhora a geração aumentada por recuperação (RAG) ao adicionar uma breve explicação específica do documento a cada bloco de dados antes de indexá-lo. Introduzida no guia de recuperação contextual da Anthropic de 2024, ela ajuda os sistemas de pesquisa a entender onde uma passagem que, de outro modo, seria ambígua se encaixa, melhorando as evidências fornecidas a um modelo de linguagem de grande escala. (anthropic.com)
Como funciona a recuperação contextual#
A RAG padrão divide os documentos em blocos e converte-os em embeddings. No entanto, um bloco como “a receita aumentou 3%” pode não indicar a empresa, o período de divulgação e o tipo de documento. A recuperação contextual utiliza o documento completo para gerar um prefixo conciso, como “Esta passagem descreve os resultados financeiros da ACME no segundo trimestre de 2025”, antes de indexar o texto combinado.
Um fluxo de trabalho típico inclui:
- Chunking semântico: Divide os documentos em passagens coerentes que se ajustem aos limites de recuperação e do modelo. O principal objetivo do chunking é tornar grandes fontes pesquisáveis sem exceder a janela de contexto do modelo.
- Geração de contexto: Utiliza um modelo para resumir a relação de cada bloco com a sua fonte, seguindo um processo semelhante ao cookbook de embeddings contextuais do Claude.
- Pesquisa híbrida: Indexa blocos contextualizados com vetores densos e métodos lexicais, como a classificação de palavras-chave BM25.
- Reclassificação: Reordena os candidatos recuperados usando comparações mais aprofundadas entre a consulta e os blocos antes de enviar as melhores evidências ao gerador.
A Anthropic relatou que os embeddings contextuais combinados com o BM25 contextual reduziram em 49% a sua taxa de falhas na recuperação dos 20 primeiros resultados, enquanto a adição de reclassificação produziu uma redução de 67% nos seus testes. Os resultados variam conforme o conjunto de dados, por isso estes valores devem ser tratados como referências de desempenho, não como garantias. (anthropic.com)
Recuperação contextual em visão computacional#
Na RAG multimodal, o contexto do documento pode incluir objetos detetados, legendas de imagens, marcas temporais, localizações de câmaras ou eventos de vídeo circundantes. O exemplo abaixo utiliza o Ultralytics YOLO26 para criar contexto pesquisável para uma imagem:
from ultralytics import YOLO
model = YOLO("yolo26n.pt")
result = model("https://ultralytics.com/images/bus.jpg")[0]
labels = [model.names[int(cls)] for cls in result.boxes.cls.tolist()]
context = f"Street-scene image containing: {', '.join(labels)}."
print(context)O texto gerado pode ser acrescentado no início da legenda da imagem ou do registo de metadados antes da criação dos embeddings. Os programadores podem explorar fluxos de trabalho de predição do YOLO e a pesquisa de similaridade visual relacionados.
Aplicações no mundo real#
- Pesquisa empresarial e jurídica: Os assistentes de políticas preservam nomes de documentos, datas, departamentos e relações entre cláusulas, reduzindo respostas enganosas baseadas em passagens isoladas.
- Sistemas de manutenção visual: As máquinas detetadas, os tipos de defeitos e as localizações das instalações fornecem contexto às imagens antes de o sistema recuperar manuais de reparação ou registos de inspeção.
- Educação personalizada: Os agentes de aprendizagem podem combinar o diálogo com o estudante e os registos de atividades para recuperar orientações relevantes para a tarefa atual do aluno.
Técnicas relacionadas e boas práticas#
A recuperação contextual difere da engenharia de contexto, que gere todas as informações fornecidas a um modelo durante a execução. Também difere da investigação sobre chunking tardio, que cria embeddings de um documento completo antes de agrupar as representações dos tokens em blocos. Uma avaliação comparativa de 2025 concluiu que a recuperação contextual é eficaz na preservação da coerência semântica, mas exige mais recursos computacionais. (arxiv.org)
As boas práticas atuais incluem testar vários tamanhos de blocos, manter os metadados da fonte, combinar recuperação densa e por palavras-chave e medir a revocação, a precisão, a fundamentação e a completude das respostas com as orientações da Microsoft para avaliação de RAG. Investigações mais recentes, como a recuperação precisa SAGE, favorecem a segmentação semântica e a seleção dinâmica de blocos, enquanto um benchmark de recuperação de 2026 apoia a recuperação híbrida e a reclassificação neural para documentos complexos com texto e tabelas. As equipas que criam sistemas de conhecimento visual podem utilizar a Ultralytics Platform para anotar conjuntos de dados, treinar modelos de visão, implementar endpoints e monitorizar os componentes que fornecem contexto visual estruturado.






