الكتابات/news/2026/07
News27 يوليو 2026·6 دقيقة

إطلاق الأوزان المفتوحة لنموذج Kimi K3 على Hugging Face: أضخم نموذج ذكاء اصطناعي مفتوح في التاريخ

أصدرت Moonshot AI اليوم الأوزان المفتوحة لنموذج Kimi K3 على منصة Hugging Face — 2.8 تريليون معامل، ونافذة سياق مليون رمز، ورخصة MIT معدّلة تتيح لأي مؤسسة استضافة أقوى نموذج ذكاء اصطناعي مفتوح في العالم على بنيتها التحتية الخاصة.

أطلقت شركة Moonshot AI اليوم، 27 يوليو 2026، الأوزان الكاملة لنموذج Kimi K3 على منصة Hugging Face، وفاءً بالوعد الذي قطعته حين كشفت عن النموذج في مؤتمر العالم للذكاء الاصطناعي بشنغهاي في 16 يوليو. بـ 2.8 تريليون معامل، يُعدّ K3 أضخم نموذج مفتوح الأوزان يُطلَق على الإطلاق، وإتاحته تعيد رسم خريطة اقتصاديات الذكاء الاصطناعي وسياساته الجيوتقنية للمؤسسات والمطورين حول العالم.

أبرز المعطيات

  • 2.8 تريليون معامل — الإصدار الأضخم في تاريخ النماذج مفتوحة الأوزان، متجاوزاً جميع سابقيه
  • 16 خبيراً من أصل 896 يعمل لكل رمز، مما يُبقي الحوسبة الفعلية في حدود 50 مليار معامل نشط لتحقيق كفاءة الاستدلال
  • نافذة سياق مليون رمز مع إمكانيات رؤية أصلية مدمجة في النموذج
  • رخصة MIT معدّلة — يمكن لأي جهة تنزيله وفحصه وضبطه الدقيق واستضافته ذاتياً
  • المرتبة الثانية على مؤشر Vals AI والأول في Frontend Code Arena من بين جميع النماذج المقيَّمة علناً
  • اختصرت الفجوة الأدائية مع نماذج الحدود من 6–9 أشهر إلى نحو 3–5 أشهر

البنية المعمارية: KDA و Stable LatentMoE

تجمع معمارية K3 بين Kimi Delta Attention (KDA) وبقايا الانتباه (AttnRes) إلى جانب إطار Stable LatentMoE — الجيل الثاني من أطر خبراء المزج لدى Moonshot. يُفعَّل 16 خبيراً فقط من أصل 896 لكل رمز، مما يجعل النموذج نادراً من حيث كثافة المعاملات النشطة على الرغم من ضخامته. تُفيد Moonshot بتحسن بلغ 2.5 مرة في كفاءة التوسع الإجمالية مقارنةً بـ Kimi K2.

تأتي قدرات الرؤية مدمجةً في النموذج الأساسي بدلاً من إضافتها عبر طبقة خارجية، مما يمكّن K3 من الاستدلال على الصور والمستندات في السياق ذاته مع الشفرة البرمجية والنص.

الاستضافة الذاتية: قدرة هائلة ومتطلبات ضخمة

تنزيل K3 مجاني. تشغيله شأن آخر. الأوزان بدقة MXFP4 ذات أربعة بتات وحدها تستهلك نحو 1.4 تيرابايت من ذاكرة GPU السريعة قبل احتساب المخازن المؤقتة وعمليات التفعيل. توصي Moonshot بأن تستخدم نشرات الإنتاج "تهيئة supernode بـ 64 مسرِّعاً أو أكثر"، مما يضع الاستدلال الحقيقي على K3 في نطاق مراكز البيانات الضخمة بعيداً عن محطات العمل الفردية.

بالنسبة للمؤسسات القادرة على تجاوز هذه الحاجز التقني، تُزيل الاستضافة الذاتية المطالبات من واجهة برمجية Moonshot كلياً، مما يُلغي مخاوف السيادة على البيانات التي يربطها كثير من القطاعات المنظَّمة بقانون الاستخبارات الوطنية الصيني.

المعايير الأدائية: على حدود الطليعة

أرقام K3 على لوحات المتصدرين العامة لافتة:

  • مؤشر Artificial Analysis للذكاء: 57، مرتبة رابعة من 189 نموذجاً
  • مؤشر Vals AI: 74.70%، مرتبة ثانية من 38 نموذجاً
  • Arena WebDev: المرتبة الأولى بنتيجة أولية 1,679
  • سرعة الإخراج: 62 رمزاً في الثانية عبر الواجهة البرمجية المستضافة
  • كمون أول رمز: 1.99 ثانية

يتفوق النموذج على جميع الإصدارات مفتوحة الأوزان السابقة في معايير البرمجة — DeepSWE وTerminal-Bench وProgram Bench — في حين يتخلف عن النماذج المغلقة الرائدة (Claude Fable 5 وGPT-5.6 Sol) في التقييمات الاستدلالية الشاملة. ووصفت مدونة Moonshot سيناريو بحثياً أنجز فيه K3 "في نحو ساعتين ما يستغرق عادةً أسبوعاً إلى أسبوعين" من العمل الخبراتي.

تسعير الواجهة البرمجية مقابل تكلفة الاستضافة الذاتية

المؤسسات التي تختار الواجهة البرمجية المستضافة لـ Moonshot تدفع:

نوع الرمزالتكلفة
إدخال ذاكرة التخزين المؤقت0.30 دولار لكل مليون رمز
إدخال خارج ذاكرة التخزين3.00 دولار لكل مليون رمز
إخراج15.00 دولار لكل مليون رمز

هذا يُكلّف ثلاثة إلى أربعة أضعاف Kimi K2.6، عكساً لقدرات K3 الموسّعة وطول سياقه. تُلغي الاستضافة الذاتية رسوم كل رمز، لكنها تُستبدَل بنفقات رأسمالية على مجموعة من 64 مسرِّعاً على الأقل.

الدلالة الجيوسياسية للأوزان المفتوحة

يُلاحظ المحللون أن هذا الإصدار يتزامن مع تعهد الرئيس الصيني شي جين بينغ العلني بدعم الذكاء الاصطناعي مفتوح المصدر والانتشار العالمي للقدرات. بإتاحة أوزان K3 برخصة مرنة، تُمكّن Moonshot أي باحث أو مؤسسة من دراسة النموذج وضبطه وإعادة توزيعه، مما يُفرز نمطاً غير متماثل في الوصول حيث تنتشر النماذج الصينية المفتوحة عالمياً بينما تظل نظيراتها الأمريكية مغلقة أو مقيَّدة بضوابط التصدير.

يُشير تحليل interconnects.ai إلى أن K3 يُثبت أن المختبرات الصينية بلغت قدرات "شبه حدودية" بـ"موارد أقل بكثير" من نظيراتها الغربية، مما يُسرّع الانتشار العالمي للذكاء الاصطناعي المتقدم بصورة تُصعّب فرض ضوابط التصدير.

ما التالي؟

ينصبّ تركيز المجتمع التقني فوراً على:

  1. دمج vLLM — تتوقع Moonshot نشر تطبيق vLLM مع دعم أصلي لـ Kimi Delta Attention
  2. نسخ مضبوطة الدقة — الرخصة المفتوحة تدعو مجتمع البحث لإنتاج نقاط تفتيش متخصصة بالمجال
  3. تقديم مضغوط — يعمل مقدمو الاستدلال على نسخ INT4 وINT8 لخفض تكلفة الرمز
  4. تدقيق القطاعات المنظَّمة — إتاحة فحص الأوزان يعالج متطلبات شفافية النماذج في الرعاية الصحية والمالية والمشتريات الحكومية

المصدر: Moonshot AI — مدونة Kimi K3