VisionTool
Descrição
Esta ferramenta é utilizada para extrair texto de imagens. Quando passada para o agente, ela extrai o texto da imagem e depois o utiliza para gerar uma resposta, relatório ou qualquer outra saída. A URL ou o CAMINHO da imagem deve ser passado para o Agente. Você também pode fazer umaquery personalizada sobre a imagem e escolher um complexity_level que seleciona automaticamente o modelo mais adequado para a solicitação:
Quando um
llm ou model explícito é fornecido à ferramenta, ele tem precedência sobre a seleção de modelo baseada na complexidade.
Instalação
Instale o pacote crewai_toolsUso
Para usar o VisionTool, a chave da API da OpenAI deve ser definida na variável de ambienteOPENAI_API_KEY.
Code
