نموذج الذكاء الاصطناعي المفتوح الذي يُضيّق الفجوة مع الحدود العليا

Kimi K3 هو أول نموذج ذكاء اصطناعي مفتوح في العالم بحجم 3 تريليون معامل من Moonshot AI، مصمم للبرمجة طويلة الأفق والعمل المعرفي والاستدلال بنافذة سياق تبلغ مليون رمز.

مصدر الصورة:

kimi-k3

ما معنى بناء أكبر نموذج ذكاء اصطناعي مفتوح في العالم

ظلت الفجوة بين ما تُطلقه مختبرات الذكاء الاصطناعي المملوكة للعملاء الدافعين وما يستطيع العالم الأوسع الوصول إليه ودراسته والبناء عليه أحد أبرز التوترات في هذا المجال. تضع النماذج المغلقة من أكثر المختبرات تمويلًا حدود القدرة العليا. أما النماذج المفتوحة فتتبعها، أحيانًا بتأخر يُقاس بالسنوات. Kimi K3 هو الجواب الأكثر مباشرة من Moonshot AI على تلك الفجوة. Kimi K3 هو نموذج بـ 2.8 تريليون معامل مبني على Kimi Delta Attention وAttention Residuals، مع قدرات رؤية أصيلة ونافذة سياق تبلغ مليون رمز. إنه أول نموذج مفتوح في العالم بحجم 3 تريليون معامل، مصمم للذكاء في البرمجة طويلة الأفق والعمل المعرفي والاستدلال.

لا يكتسب هذا الحجم أهميته بوصفه مقياسًا للمباهاة بل بوصفه تصريحًا هندسيًا. يُمثّل Kimi K3 أحدث خطوة في مسيرة ثابتة عند حدود القدرة العليا، إذ حافظت نماذج Kimi لتسعة من الاثني عشر شهرًا الماضية على الحد الأعلى لأحجام النماذج المفتوحة. لا يزال الأداء العام للنموذج يتراجع أمام أقوى الأنظمة الملكية المتاحة حاليًا، Claude Fable 5 وGPT 5.6 Sol، لكنه أظهر أداءً عند مستوى الحدود العليا عبر مجموعة تقييم واسعة، متفوقًا باستمرار على جميع النماذج المُختبَرة الأخرى خارج تلك الفئة العليا.

كيف تُحوّل البنية الكامنة خلف K3 الحجمَ إلى ذكاء

نموذج بـ 2.8 تريليون معامل لا يكتسب قيمته إلا إذا استخدمت بنيته ذلك الحجم بكفاءة فعلية، وهنا تصنع الخيارات الهندسية في Kimi K3 الفرق الحقيقي. يُبنى النموذج على ابتكارَين معماريَّين أساسيَّين: Kimi Delta Attention وAttention Residuals. يوفر Kimi Delta Attention أساسًا فعّالًا لتوسيع الانتباه عبر تسلسلات طويلة، بينما تسترجع Attention Residuals تمثيلات عبر عمق النموذج بدلًا من تراكمها بشكل منتظم، محسّنةً كيفية تدفق المعلومات عبر النموذج في المهام التي تتطلب استدلالًا مستمرًا عبر مدخلات طويلة جدًا.

فوق تلك الابتكارات في الانتباه، يستخدم K3 إطار Stable LatentMoE، وهو إطار Mixture of Experts يُنشّط فعليًا 16 خبيرًا من أصل 896 خبيرًا لكل رمز أثناء الاستدلال. تعني تلك الندرة الشديدة أن النموذج ينشر جزءًا من معاملاته الإجمالية على أي مهمة معينة، مُبقيًا تكاليف الاستدلال قابلة للإدارة مع الاحتفاظ بالطاقة التعبيرية الكاملة لبنية 2.8 تريليون معامل. تشمل الابتكارات الإضافية Quantile Balancing لتخصيص الخبراء وPer-Head Muon لتحسين الانتباه التكيفي والتدريب الواعي بالتكميم باستخدام أوزان MXFP4 مع تنشيطات MXFP8 لتوافق واسع مع الأجهزة. وتُنتج هذه الخيارات الهيكلية مجتمعةً مع وصفات التدريب والبيانات المُحسَّنة كفاءة قياسية تبلغ تقريبًا 2.5 ضعفًا مقارنة بـ Kimi K2، مما يتيح لـ K3 تحويل القدرة الحسابية إلى ذكاء بفعالية أكبر بكثير من سلفه.كيف تُحوّل البنية الكامنة خلف K3 الحجمَ إلى ذكاء

ما الذي يفعله K3 فعليًا ولم يفعله أي نموذج مفتوح من قبل

يأتي أوضح دليل على ما يُغيّره K3 من عروض المهام الواقعية لا من أرقام المعايير وحدها. في تحسين النوى البرمجية، عمل K3 بشكل مستقل في بيئة تجريبية مُتحكَّم بها لتحليل نوى GPU وإعادة كتابتها وقياس أدائها عبر منصات أجهزة متعددة، منافسًا أفضل النماذج الملكية في تلك المهمة. والأكثر لفتًا للنظر أن إصدارًا مبكرًا من K3 في المراحل الأخيرة من تطويره تولى معظم أعمال تحسين النوى البرمجية التي كان الفريق ينجزها، مما يجعله من بين أوائل نماذج الذكاء الاصطناعي التي أسهمت بشكل ملموس في هندسة الجيل التالي من نفسها.

لتطوير مُصرِّف GPU، بنى K3 MiniTriton من الصفر: مُصرِّف مدمج يشبه Triton مع طبقة تمثيل وسيطة خاصة به على مستوى الشرائح وممرات تحسين وخط أنابيب لتوليد كود PTX. عبر المعايير المدعومة، قدّم MiniTriton أداءً مماثلًا أو أفضل من Triton وtorch. Compile، وحافظ على تدريب شبكة عصبية كاملة من البداية إلى النهاية بتقارب مستقر. أما تصميم الرقاقة، فقد أنجز K3 في جلسة مستقلة واحدة لمدة 48 ساعة ما يستغرق فريقًا من المهندسين أسابيع عادةً: تصميم رقاقة لخدمة نموذج نانو مبني على بنيته الخاصة، باستخدام أدوات EDA مفتوحة المصدر. ضمن مساحة 4mm²، تُغلق الرقاقة التوقيت عند 100MHz وتحافظ على أكثر من 8,700 رمز في الثانية في إنتاجية فك التشفير في المحاكاة. رقاقة بناها نموذج، لخدمة نموذج، تُمثّل أحد أكثر العروض إثارةً لقدرات الذكاء الاصطناعي الواكل طويل الأفق التي أنتجها أي نظام ذكاء اصطناعي.

كيف يتعامل K3 مع العمل المعرفي والمهام متعددة الوسائط

بعيدًا عن البرمجة والهندسة، يُقدّم K3 ما تُسميه Moonshot AI العمل المعرفي من البداية إلى النهاية. في حالة موثقة، أكمل K3 في غضون ساعتَين تقريبًا ما يستغرق عادةً أسبوعًا إلى أسبوعَين من عمل باحث متمرس: إعادة إنتاج علاقات I-Love-Q الكونية في الفيزياء الفلكية الحسابية، وهو ما استلزم مراجعة أكثر من عشرين ورقة بحثية والتحقق المتقاطع منها وتطبيق خط أنابيب عددي كامل وتقييم أكثر من 300 معادلة حالة وتحديد تناقضات في صيغ منشورة وتوليد أكثر من 3,000 سطر من كود Python وإنتاج لوحة تفاعلية HTML لاستكشاف النتائج.

تُعالج البنية متعددة الوسائط الأصيلة في النموذج النص والصور والفيديو ضمن نفس النموذج بدلًا من خطوط أنابيب منفصلة مُجمَّعة معًا. يتيح هذا لـ K3 استخدام لقطات الشاشة كجزء من حلقات الاستدلال النشطة خلال مهام البرمجة وتطوير الألعاب، مُتناوبًا بين الكود والمخرجات البصرية الحية بدلًا من العمل بشكل أعمى. علاوة على ذلك، حرّر K3 الفيديو التشويقي الخاص به من 56 مقطعًا مصدريًا، متعاملًا مع اختيار المقاطع والمونتاج المتطابق مع الحركة ومزامنة الإيقاع الدقيقة بالإطار ومعالجة الصوت عبر جولات تحرير متعددة، وهو عمل يستغرق عادةً من محرر متمرس يومًا إلى يومَين من العمل. كذلك، يُشغّل K3 في Kimi Work ميزتَين جديدتَين، Widgets وDashboard، تتيحان للمستخدمين توليد مكوّنات تفاعلية مباشرة داخل المحادثة وتنظيمها في عرض شخصي مستمر، مما يجعل العمل المعرفي أكثر بصرية واستمرارية بدلًا من الاعتماد على جلسات منفصلة.

أين يقف K3 ولماذا تُغيّر الانفتاحية القصة

Kimi K3 صادق بشأن موقعه. بينما أظهر K3 أداءً عند مستوى الحدود العليا وتفوّق باستمرار على النماذج المُختبَرة الأخرى، لا يزال أداؤه العام يتراجع أمام أقوى الأنظمة الملكية المتاحة حاليًا. ما يجعله مهمًا ليس ادعاء كونه أفضل نموذج في العالم، بل إثباته أن الفجوة بين النماذج المفتوحة والمغلقة قد ضاقت إلى النقطة التي باتا فيها في نفس المحادثة بشكل ذي معنى.

تحمل الأوزان المفتوحة قيمة مختلفة عن الوصول عبر API. النموذج المغلق مهما بلغت قدرته لا يمكن استخدامه إلا عبر واجهة المورد بسعره وشروطه. أما النموذج المفتوح فيمكن دراسته وضبطه الدقيق ونشره على البنية التحتية الخاصة والبناء عليه من قِبَل أي شخص يمتلك القدرة الحسابية لتشغيله. ستُطلَق الأوزان الكاملة لـ Kimi K3 بموجب ترخيص Modified MIT المعدَّل، مما يجعله قابلًا للاستخدام التجاري الحر. متاح الآن على Kimi.com وKimi Work وKimi Code وKimi API، بتسعير يبلغ 3 دولارات لكل مليون رمز مدخل و15 دولارًا لكل مليون رمز مُخرَج، يضع K3 الذكاء الاصطناعي مفتوح الأوزان كشيء لم يعد يتطلب مقايضة ذات معنى في القدرة مقابل أفضل الأنظمة الملكية المتاحة.

Lock

لقد تجاوزت حدودك المجانية لمشاهدة المحتوى المميز لدينا

يرجى الاشتراك للحصول على وصول غير محدود إلى ابتكاراتنا.