Kimi K3 هو أول نموذج ذكاء اصطناعي مفتوح في العالم بحجم 3 تريليون معامل من Moonshot AI، مصمم للبرمجة طويلة الأفق والعمل المعرفي والاستدلال بنافذة سياق تبلغ مليون رمز.
مصدر الصورة:
kimi-k3
ظلت الفجوة
بين ما تُطلقه مختبرات الذكاء الاصطناعي المملوكة للعملاء الدافعين وما يستطيع
العالم الأوسع الوصول إليه ودراسته والبناء عليه أحد أبرز التوترات في هذا المجال.
تضع النماذج المغلقة من أكثر المختبرات تمويلًا حدود القدرة العليا. أما النماذج
المفتوحة فتتبعها، أحيانًا بتأخر يُقاس بالسنوات. Kimi K3 هو الجواب الأكثر مباشرة من Moonshot AI على تلك الفجوة. Kimi K3 هو نموذج بـ 2.8 تريليون معامل مبني على Kimi Delta Attention وAttention Residuals،
مع قدرات رؤية أصيلة ونافذة سياق تبلغ مليون رمز. إنه أول نموذج مفتوح في العالم
بحجم 3 تريليون معامل، مصمم للذكاء في البرمجة طويلة الأفق والعمل المعرفي
والاستدلال.
لا يكتسب هذا
الحجم أهميته بوصفه مقياسًا للمباهاة بل بوصفه تصريحًا هندسيًا. يُمثّل Kimi K3 أحدث خطوة في مسيرة ثابتة عند حدود القدرة
العليا، إذ حافظت نماذج Kimi لتسعة من الاثني عشر شهرًا الماضية على الحد
الأعلى لأحجام النماذج المفتوحة. لا يزال الأداء العام للنموذج يتراجع أمام أقوى
الأنظمة الملكية المتاحة حاليًا، Claude Fable 5
وGPT 5.6 Sol، لكنه أظهر أداءً عند مستوى الحدود العليا
عبر مجموعة تقييم واسعة، متفوقًا باستمرار على جميع النماذج المُختبَرة الأخرى
خارج تلك الفئة العليا.
نموذج بـ 2.8
تريليون معامل لا يكتسب قيمته إلا إذا استخدمت بنيته ذلك الحجم بكفاءة فعلية، وهنا
تصنع الخيارات الهندسية في Kimi
K3 الفرق
الحقيقي. يُبنى النموذج على ابتكارَين معماريَّين أساسيَّين: Kimi Delta Attention وAttention Residuals.
يوفر Kimi Delta Attention أساسًا فعّالًا لتوسيع الانتباه عبر تسلسلات
طويلة، بينما تسترجع Attention
Residuals تمثيلات عبر
عمق النموذج بدلًا من تراكمها بشكل منتظم، محسّنةً كيفية تدفق المعلومات عبر
النموذج في المهام التي تتطلب استدلالًا مستمرًا عبر مدخلات طويلة جدًا.
فوق تلك
الابتكارات في الانتباه، يستخدم K3 إطار Stable LatentMoE، وهو إطار Mixture of Experts يُنشّط فعليًا 16 خبيرًا من أصل 896 خبيرًا
لكل رمز أثناء الاستدلال. تعني تلك الندرة الشديدة أن النموذج ينشر جزءًا من
معاملاته الإجمالية على أي مهمة معينة، مُبقيًا تكاليف الاستدلال قابلة للإدارة مع
الاحتفاظ بالطاقة التعبيرية الكاملة لبنية 2.8 تريليون معامل. تشمل الابتكارات
الإضافية Quantile
Balancing لتخصيص
الخبراء وPer-Head Muon لتحسين الانتباه التكيفي والتدريب الواعي
بالتكميم باستخدام أوزان MXFP4 مع تنشيطات MXFP8
لتوافق واسع مع الأجهزة. وتُنتج هذه الخيارات الهيكلية مجتمعةً مع وصفات التدريب
والبيانات المُحسَّنة كفاءة قياسية تبلغ تقريبًا 2.5 ضعفًا مقارنة بـ Kimi K2، مما يتيح لـ K3
تحويل القدرة الحسابية إلى ذكاء بفعالية أكبر بكثير من سلفه.
يأتي أوضح
دليل على ما يُغيّره K3 من عروض المهام الواقعية لا من أرقام
المعايير وحدها. في تحسين النوى البرمجية، عمل K3
بشكل مستقل في بيئة تجريبية مُتحكَّم بها لتحليل نوى GPU
وإعادة كتابتها وقياس أدائها عبر منصات أجهزة متعددة، منافسًا أفضل النماذج
الملكية في تلك المهمة. والأكثر لفتًا للنظر أن إصدارًا مبكرًا من K3 في المراحل الأخيرة من تطويره تولى معظم
أعمال تحسين النوى البرمجية التي كان الفريق ينجزها، مما يجعله من بين أوائل نماذج
الذكاء الاصطناعي التي أسهمت بشكل ملموس في هندسة الجيل التالي من نفسها.
لتطوير
مُصرِّف GPU، بنى K3 MiniTriton من الصفر: مُصرِّف مدمج يشبه Triton مع طبقة تمثيل وسيطة خاصة به على مستوى
الشرائح وممرات تحسين وخط أنابيب لتوليد كود PTX.
عبر المعايير المدعومة، قدّم MiniTriton أداءً مماثلًا أو أفضل من Triton وtorch. Compile،
وحافظ على تدريب شبكة عصبية كاملة من البداية إلى النهاية بتقارب مستقر. أما تصميم
الرقاقة، فقد أنجز K3 في جلسة مستقلة واحدة لمدة 48 ساعة ما
يستغرق فريقًا من المهندسين أسابيع عادةً: تصميم رقاقة لخدمة نموذج نانو مبني على
بنيته الخاصة، باستخدام أدوات EDA مفتوحة
المصدر. ضمن مساحة 4mm²، تُغلق الرقاقة التوقيت عند 100MHz وتحافظ على أكثر من 8,700 رمز في الثانية في
إنتاجية فك التشفير في المحاكاة. رقاقة بناها نموذج، لخدمة نموذج، تُمثّل أحد أكثر
العروض إثارةً لقدرات الذكاء الاصطناعي الواكل طويل الأفق التي أنتجها أي نظام
ذكاء اصطناعي.
بعيدًا عن
البرمجة والهندسة، يُقدّم K3 ما تُسميه Moonshot AI العمل المعرفي من البداية إلى النهاية. في
حالة موثقة، أكمل K3 في غضون ساعتَين تقريبًا ما يستغرق عادةً
أسبوعًا إلى أسبوعَين من عمل باحث متمرس: إعادة إنتاج علاقات I-Love-Q الكونية في الفيزياء الفلكية الحسابية، وهو
ما استلزم مراجعة أكثر من عشرين ورقة بحثية والتحقق المتقاطع منها وتطبيق خط
أنابيب عددي كامل وتقييم أكثر من 300 معادلة حالة وتحديد تناقضات في صيغ منشورة
وتوليد أكثر من 3,000 سطر من كود Python وإنتاج لوحة
تفاعلية HTML لاستكشاف النتائج.
تُعالج البنية
متعددة الوسائط الأصيلة في النموذج النص والصور والفيديو ضمن نفس النموذج بدلًا من
خطوط أنابيب منفصلة مُجمَّعة معًا. يتيح هذا لـ K3
استخدام لقطات الشاشة كجزء من حلقات الاستدلال النشطة خلال مهام البرمجة وتطوير
الألعاب، مُتناوبًا بين الكود والمخرجات البصرية الحية بدلًا من العمل بشكل أعمى.
علاوة على ذلك، حرّر K3 الفيديو التشويقي الخاص به من 56 مقطعًا
مصدريًا، متعاملًا مع اختيار المقاطع والمونتاج المتطابق مع الحركة ومزامنة
الإيقاع الدقيقة بالإطار ومعالجة الصوت عبر جولات تحرير متعددة، وهو عمل يستغرق عادةً
من محرر متمرس يومًا إلى يومَين من العمل. كذلك، يُشغّل K3
في Kimi Work ميزتَين جديدتَين، Widgets وDashboard،
تتيحان للمستخدمين توليد مكوّنات تفاعلية مباشرة داخل المحادثة وتنظيمها في عرض
شخصي مستمر، مما يجعل العمل المعرفي أكثر بصرية واستمرارية بدلًا من الاعتماد على
جلسات منفصلة.
Kimi
K3 صادق بشأن
موقعه. بينما أظهر K3 أداءً عند مستوى الحدود العليا وتفوّق
باستمرار على النماذج المُختبَرة الأخرى، لا يزال أداؤه العام يتراجع أمام أقوى
الأنظمة الملكية المتاحة حاليًا. ما يجعله مهمًا ليس ادعاء كونه أفضل نموذج في
العالم، بل إثباته أن الفجوة بين النماذج المفتوحة والمغلقة قد ضاقت إلى النقطة
التي باتا فيها في نفس المحادثة بشكل ذي معنى.
تحمل الأوزان
المفتوحة قيمة مختلفة عن الوصول عبر API. النموذج
المغلق مهما بلغت قدرته لا يمكن استخدامه إلا عبر واجهة المورد بسعره وشروطه. أما
النموذج المفتوح فيمكن دراسته وضبطه الدقيق ونشره على البنية التحتية الخاصة
والبناء عليه من قِبَل أي شخص يمتلك القدرة الحسابية لتشغيله. ستُطلَق الأوزان
الكاملة لـ Kimi K3 بموجب ترخيص Modified MIT المعدَّل، مما يجعله قابلًا للاستخدام
التجاري الحر. متاح الآن على Kimi.com وKimi Work
وKimi Code وKimi API،
بتسعير يبلغ 3 دولارات لكل مليون رمز مدخل و15 دولارًا لكل مليون رمز مُخرَج، يضع K3 الذكاء الاصطناعي مفتوح الأوزان كشيء لم يعد
يتطلب مقايضة ذات معنى في القدرة مقابل أفضل الأنظمة الملكية المتاحة.
يرجى الاشتراك للحصول على وصول غير محدود إلى ابتكاراتنا.