Skip to main content

VisionTool

Descrição

Esta ferramenta é utilizada para extrair texto de imagens. Quando passada para o agente, ela extrai o texto da imagem e depois o utiliza para gerar uma resposta, relatório ou qualquer outra saída. A URL ou o CAMINHO da imagem deve ser passado para o Agente. Você também pode fazer uma query personalizada sobre a imagem e escolher um complexity_level que seleciona automaticamente o modelo mais adequado para a solicitação: Quando um llm ou model explícito é fornecido à ferramenta, ele tem precedência sobre a seleção de modelo baseada na complexidade.

Instalação

Instale o pacote crewai_tools

Uso

Para usar o VisionTool, a chave da API da OpenAI deve ser definida na variável de ambiente OPENAI_API_KEY.
Code

Argumentos

O VisionTool aceita os seguintes argumentos: