الكتابات/blog/2026/08
Blog7 أغسطس 2026·6 دقيقة

دليل API جروك 4.5: وكلاء ذكاء اصطناعي بنصف التكلفة

جروك 4.5 يحتل المرتبة الأولى في اختبارات الوكلاء الآليين، متوافق مع OpenAI SDK، بسعر 2 دولار/6 دولارات لكل مليون رمز. دليل عملي لبناء وكلاء الذكاء الاصطناعي على API شركة xAI.

أطلقت شركة xAI نموذجها جروك 4.5 في الثامن من يوليو 2026. بعد ثلاثة أسابيع من الإطلاق، صنّفته مؤسسة Artificial Analysis في المرتبة الأولى عالمياً في معيار استخدام الأدوات الوكيلة — متفوقاً على جميع نماذج Claude وGPT وGemini. وجاء ذلك بتكلفة 2 دولار لكل مليون رمز مدخل، و6 دولارات لكل مليون رمز مُخرج، مع توافق كامل مع مكتبة OpenAI SDK التي يستخدمها معظم المطورين بالفعل.

إذا كنت تبني وكلاء ذكاء اصطناعي للعملاء في منطقة الخليج وتلجأ بشكل افتراضي إلى Claude أو GPT دون مراجعة البدائل، فإن جروك 4.5 يستحق التقييم قبل نشر مشروعك القادم.

الأرقام التي تهم بانيي الوكلاء

المعيارنتيجة جروك 4.5
استخدام الأدوات الوكيلة (Artificial Analysis)المرتبة الأولى من بين جميع النماذج
Terminal Bench 2.183.3%
SWE-Bench Pro64.7%
مؤشر الذكاء الإجمالي (Artificial Analysis)المرتبة الرابعة (54 نقطة)

يستهلك جروك 4.5 نحو 15,954 رمزاً مُخرجاً لكل مهمة في SWE-Bench Pro، وهو ما يجعله أكثر كفاءة بأربعة أضعاف تقريباً مقارنةً بـ Claude Opus 4.8 على نفس المعيار. والفارق أكبر عند النظر إلى التكلفة: 6 دولارات مقابل 75 دولاراً لكل مليون رمز مُخرج.

تحذير مهم: رصدت جهات تقييم مستقلة معدل هلوسة بلغ 54% في بعض إعدادات الاختبار — تراجع ملحوظ عن معدل 25% المُسجَّل في نماذج xAI السابقة. لم تُعالج الشركة هذا الرقم في وثائقها الرسمية. يجب أخذ ذلك في الاعتبار عند تصميم الحلول الإنتاجية.

البداية: التوافق مع OpenAI SDK

يعمل جروك 4.5 مع مكتبتَي OpenAI Python وJavaScript. التغيير الوحيد عن أي استدعاء OpenAI اعتيادي هو عنوان الـ base URL ومعرّف النموذج:

import os
from openai import OpenAI
 
client = OpenAI(
    api_key=os.environ["XAI_API_KEY"],
    base_url="https://api.x.ai/v1",
)
 
response = client.chat.completions.create(
    model="grok-4.5",
    reasoning_effort="high",
    messages=[
        {"role": "system", "content": "أنت مساعد تقني دقيق."},
        {"role": "user", "content": "حلّل هذا المخطط SQL وحدّد مشكلات التطبيع."}
    ]
)
print(response.choices[0].message.content)

يأتي مفتاح XAI_API_KEY من لوحة تحكم المطورين على منصة x.ai. إذا كنت تمتلك تكاملاً قائماً مع OpenAI، فالترحيل لا يتطلب سوى تغيير سطرَين: تحديث عنوان القاعدة واستبدال معرّف النموذج.

معامل reasoning_effort

يوفر جروك 4.5 معاملاً اسمه reasoning_effort بثلاثة مستويات: low وmedium وhigh (الافتراضي).

high يُفعّل التفكير الموسّع قبل توليد المُخرج. استخدمه في التخطيط متعدد الخطوات للوكلاء، ومراجعة الكود المعقد، أو أي مهمة يكون فيها الخطأ مكلفاً.

medium يوازن بين السرعة والعمق. مناسب لتلخيص المستندات، واستخراج البيانات المنظمة، أو خطوات الوكيل ذات النطاق المحدود.

low يُشغّل استدلالاً سريعاً. استخدمه في التصنيف والتوجيه واستشعار النية داخل خط أنابيب أكبر حيث يتولى وكيل لاحق المهام الأصعب.

في المعماريات متعددة الوكلاء، تحويل خطوات التنسيق إلى low والاحتفاظ بـ high للعقد الحرجة يُخفّض تكلفة كل خط أنابيب بشكل ملموس. راجع دليل تحسين تكاليف AI API للاطلاع على مثال عملي لتوجيه النماذج.

أين يتفوق جروك 4.5

تصنيفه في المرتبة الأولى لاستخدام الأدوات الوكيلة ليس صدفة. تدرّب النموذج بالتعاون مع Cursor وبُني أساساً حول استدعاء الأدوات متعدد الخطوات، وتوليد الكود، وتنفيذ المهام ذات الأفق الطويل.

يُجيد النموذج:

  • حلقات الوكيل متعددة الأدوات — استدعاءات متسلسلة أو متوازية مع تتبع دقيق للحالة عبر الخطوات
  • توليد الكود على نطاق واسع — نتيجة 83.3% على Terminal Bench تضعه جنباً إلى جنب مع GPT-5.5
  • استرداد السياق الواسع — 500 ألف رمز تستوعب معظم قواعد مستندات المؤسسات دون تقسيم
  • خطوط الأنابيب الحساسة للتكلفة — بـ 6 دولارات مُخرجاً مقابل 75 دولاراً لـ Claude Opus 4.8

إذا كانت سير عملك تعتمد على تنسيق أطر عمل وكلاء متعددة أو تشغيل المهام الوكيلية المتوازية بميزانية محدودة، فجروك 4.5 مرشح قوي للفتحة الأساسية أو المتوسطة في بنيتك.

متى تختار نموذجاً آخر

لا يُناسب جروك 4.5 كل حالة استخدام:

المجالات الحساسة للدقة. معدل هلوسة 54% في الإعدادات المُقيَّمة ليس مجرد رقم نظري. التطبيقات الطبية والقانونية والمالية التي تتطلب دقة تامة في المُخرجات تحتاج إلى طبقات تحقق إضافية أو نموذجاً بملف دقة موثّق.

متطلبات السياق فوق 500 ألف رمز. توفر بعض المنافسين نوافذ سياق تتجاوز المليون رمز. إذا كنت تعالج تاريخ قواعد كود كاملة، أو مجموعات امتثال موسّعة، فالحد الأقصى للسياق مقيّد هنا.

حوكمة المؤسسات مع مسارات التدقيق. لم تنشر xAI تقرير تقييم سلامة رسمياً لجروك 4.5. إذا كان نشرك يستلزم أدلة موثّقة لمراجعات الامتثال — SDAIA أو PDPL أو أُطر تدقيق قطاعية — فهذه ثغرة حقيقية. الحل: ضع آليات إيقاف طارئ، ونطاق مهام محدود، وتسجيل منظم قبل أي نشر مستقل موسّع.

للاطلاع على إطار قرار شامل للاختيار بين نماذج التفكير والنماذج السريعة، راجع نماذج التفكير مقابل النماذج السريعة.

قائمة التحقق قبل الإنتاج

قبل نقل جروك 4.5 إلى خط أنابيب وكيل حي:

  1. حدّد نطاق المهمة. اضبط الحد الأقصى لعمق استدعاء الأدوات ومدة التشغيل المستقل بشكل صريح.
  2. سجّل كل مُخرج للتفكير. احتفظ بإعدادات reasoning_effort وردود النموذج لأغراض التدقيق.
  3. تحقق من عتبة الهلوسة الخاصة بك. نفّذ عينة تمثيلية من مهام مجالك قبل الترقية للإنتاج.
  4. راقب تكاليف API لكل خطوة. يؤثر مستوى reasoning_effort على عدد الرموز لكل استدعاء.
  5. اثبّت إصدار النموذج. أعلنت xAI عن جروك 4.6 قريباً. اثبّت المعرّف grok-4.5 لتجنب سلوك غير متوقع عند أي تحديث تلقائي.

معادلة التكلفة

بسعر 2 دولار مدخلاً / 6 دولارات مُخرجاً لكل مليون رمز، يتناسب جروك 4.5 بشكل ملائم مع خطوط الأنابيب الوكيلة ذات التكلفة المُدارة. التوافق مع OpenAI SDK يُلغي تكلفة الترحيل التي قد تُبرر البقاء على مزود أغلى.

تحذير الهلوسة حقيقي. ثغرة الحوكمة حقيقية. لكن كليهما غير مفاجئ في إصدارات النماذج الحدودية — وكلاهما ذو دلالة تشغيلية في نشرات الخليج والقطاعات المنظمة حيث يحمل الرد الخاطئ من API تبعات امتثال، لا مجرد احتكاك في تجربة المستخدم.

إذا كان فريقك يُقيّم تكاليف نماذج الذكاء الاصطناعي مقابل الأداء لبناء وكيل في المنطقة، نُجري هذا النوع من مراجعات المعمارية بشكل منتظم. ابدأ بمحادثة تشخيصية.