> ## Documentation Index
> Fetch the complete documentation index at: https://crewai-cursor-default-model-gpt-5-6-luna.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# أداة الرؤية

> أداة `VisionTool` مصممة لاستخراج النص من الصور.

# `VisionTool`

## الوصف

تُستخدم هذه الأداة لاستخراج النص من الصور. عند تمريرها إلى الوكيل، ستستخرج النص من الصورة ثم تستخدمه لتوليد استجابة أو تقرير أو أي مخرج آخر.
يجب تمرير عنوان URL أو مسار الصورة إلى الوكيل.

يمكنك أيضًا طرح استعلام `query` مخصص حول الصورة واختيار مستوى تعقيد `complexity_level` يقوم تلقائيًا باختيار النموذج الأنسب للطلب:

| مستوى التعقيد      | النموذج         |
| :----------------- | :-------------- |
| `easy`             | `gpt-5.6-luna`  |
| `medium` (افتراضي) | `gpt-5.6-terra` |
| `hard`             | `gpt-5.6-sol`   |

عند تمرير `llm` أو `model` بشكل صريح إلى الأداة، فإنه يأخذ الأولوية على اختيار النموذج المستند إلى مستوى التعقيد.

## التثبيت

ثبّت حزمة crewai\_tools

```shell theme={null}
pip install 'crewai[tools]'
```

## الاستخدام

لاستخدام VisionTool، يجب تعيين مفتاح API الخاص بـ OpenAI في متغير البيئة `OPENAI_API_KEY`.

```python Code theme={null}
from crewai_tools import VisionTool

vision_tool = VisionTool()

@agent
def researcher(self) -> Agent:
    '''
    This agent uses the VisionTool to extract text from images.
    '''
    return Agent(
        config=self.agents_config["researcher"],
        allow_delegation=False,
        tools=[vision_tool]
    )
```

## المعاملات

تقبل VisionTool المعاملات التالية:

| المعامل               | النوع    | الوصف                                                                                                                 |
| :-------------------- | :------- | :-------------------------------------------------------------------------------------------------------------------- |
| **image\_path\_url**  | `string` | **إلزامي**. مسار ملف الصورة (أو عنوان URL) المراد استخراج النص منها.                                                  |
| **query**             | `string` | **اختياري**. السؤال أو التعليمات المراد طرحها على النموذج حول الصورة. القيمة الافتراضية هي `"What's in this image?"`. |
| **complexity\_level** | `string` | **اختياري**. مستوى تعقيد الطلب، والذي يحدد النموذج: `easy` أو `medium` أو `hard`. القيمة الافتراضية هي `medium`.      |
