VisionTool
الوصف
تُستخدم هذه الأداة لاستخراج النص من الصور. عند تمريرها إلى الوكيل، ستستخرج النص من الصورة ثم تستخدمه لتوليد استجابة أو تقرير أو أي مخرج آخر. يجب تمرير عنوان URL أو مسار الصورة إلى الوكيل. يمكنك أيضًا طرح استعلامquery مخصص حول الصورة واختيار مستوى تعقيد complexity_level يقوم تلقائيًا باختيار النموذج الأنسب للطلب:
عند تمرير
llm أو model بشكل صريح إلى الأداة، فإنه يأخذ الأولوية على اختيار النموذج المستند إلى مستوى التعقيد.
التثبيت
ثبّت حزمة crewai_toolsالاستخدام
لاستخدام VisionTool، يجب تعيين مفتاح API الخاص بـ OpenAI في متغير البيئةOPENAI_API_KEY.
Code
