Skip to main content

VisionTool

설명

이 도구는 이미지에서 텍스트를 추출하는 데 사용됩니다. 에이전트에 전달되면 이미지에서 텍스트를 추출한 후 이를 사용하여 응답, 보고서 또는 기타 출력을 생성합니다. 이미지의 URL 또는 경로(PATH)를 에이전트에 전달해야 합니다. 이미지에 대한 사용자 지정 query를 요청하고, 요청에 가장 적합한 모델을 자동으로 선택하는 complexity_level을 지정할 수도 있습니다: 도구에 명시적인 llm 또는 model을 제공하면, 복잡도 기반 모델 선택보다 우선합니다.

설치

crewai_tools 패키지를 설치하세요

사용법

VisionTool을 사용하려면 OpenAI API 키를 환경 변수 OPENAI_API_KEY에 설정해야 합니다.
Code

인수

VisionTool은 다음과 같은 인수를 받습니다: