Vision
Entrada de imagens e compreensão visual no ClickHouse Agents
O Vision permite que os usuários façam upload de imagens para um agente analisar. O agente passa a imagem para um modelo compatível com Vision, que descreve, resume ou responde a perguntas sobre o que há nela.
O Vision só funciona com modelos compatíveis com entrada de imagens. Se o modelo selecionado não conseguir processar imagens como entrada, o controle de upload na área de composição da mensagem ficará desabilitado.
Mude para um modelo compatível com Vision em parâmetros do modelo para reativá-lo.
Clique no ícone de clipe de papel no canto inferior esquerdo da área de composição da mensagem e escolha Upload to Provider para anexar uma imagem — uma captura de tela, uma foto, um gráfico ou um diagrama. Em seguida, faça qualquer pergunta que exija a leitura da imagem: “O que há de errado com este plano de execução da consulta?”, “Transcreva o texto desta captura de tela” ou “Compare este dashboard com o da semana passada.”
O agente trata a imagem como parte do contexto da mensagem, então perguntas de acompanhamento na mesma interação podem fazer referência ao que ele viu sem precisar reenviá-la.
O Vision combina bem com o code interpreter para análises baseadas em imagens — por exemplo, o agente extrai números de uma captura de tela e depois executa Python para calcular totais — e com a web search quando uma imagem faz referência a algo que o modelo precisa pesquisar.
Última modificação em 12 de junho de 2026