الخلاصة
- دخلت رقاقة Groq 3 LPX الإنتاج الكامل، مع تبني Nebius لها لتشغيل خدمة الاستدلال Token Factory.
- تتوسع منظومة الوكلاء عبر رقاقات ونماذج برمجية ومعايير اكتشاف ومدفوعات مستقلة.
- تعكس التحركات تسارع الإنفاق على البنية التحتية والتنافس لبناء منصات متكاملة للذكاء الاصطناعي الوكيلي.
الحدث
وسّعت إنفيديا بنية الذكاء الاصطناعي الوكيلي بإدخال رقاقة Groq 3 LPX الإنتاج الكامل وإعلان تبني SpaceXAI معالج Vera، بالتزامن مع توسيع أمازون وأوبن إيه آي النماذج وأدوات اكتشاف الوكلاء ومدفوعاتهم. وسعّرت علي بابا طرح أسهم بـ80 مليار دولار هونغ كونغي، لتوجيه صافي حصيلته بالكامل إلى قدراتها المتكاملة في الذكاء الاصطناعي، ومنها توسيع بنيتها التحتية وتعزيزها.
التفاصيل
- رقاقة الاستدلال: تعتمد Groq 3 LPX على تقنية LPU المرخصة من Groq، وتوسع منصة Vera Rubin المصممة للاستدلال التفاعلي. وتقول إنفيديا إن الرقاقة تولد حتى 3400 رمز مخرجات في الثانية لنموذج Gemma 4 ذي 31 مليار معلمة ونافذة سياق من 100 ألف رمز، مع استجابة أسرع بما يصل إلى أربع مرات. وأصبحت Nebius أول عميل لها عبر خدمة Token Factory.
- كفاءة فيرا روبن: قالت إنفيديا إن نظام Vera Rubin NVL72 يحقق إنتاجية أعلى 30 مرة لكل ميغاواط، وكلفة أقل 35 مرة لكل رمز، مقارنة بنظام GB300 NVL72 السابق، استناداً إلى اختبار AgentX من شركة SemiAnalysis. ووصف الرئيس التنفيذي جنسن هوانغ الاستدلال بأنه «محرك نمو الذكاء الاصطناعي»، مع التركيز على تجهيزات محسنة لأعباء عمل الوكلاء.
- توسع إلى المدار: ستتبنى SpaceXAI معالج Vera لتسريع أعباء الوكلاء، وتوسيع بنية Grok عبر منصة Vera Rubin نحو قدرات على مستوى الغيغاواط. وتشمل الخطة وضع أنظمة Vera Rubin NVL72 على متن الجيل الأول من قمر Starmind. ويضم المعالج 88 نواة Olympus وذاكرة LPDDR5X بنطاق يصل إلى 1.2 تيرابايت في الثانية.
- نماذج للبرمجة: أتاحت أوبن إيه آي عائلة GPT-5.6، بإصدارات Sol وTerra وLuna، داخل منصة Kiro التابعة لأمازون، لملاءمة الذكاء والسرعة والكلفة مع مراحل التخطيط والبناء والمراجعة والاختبار. وقدرت الشركة انخفاض كلفة إصدار Terra بنحو 82% على معيار Terminal-Bench 2.1 داخل Kiro.
- اكتشاف الوكلاء: كشفت AWS عن سجل مركزي لإدارة الوكلاء وخوادم MCP والأدوات والمهارات، إلى جانب مواصفة Agentic Resource Discovery المفتوحة بترخيص Apache 2.0. وتعمل المواصفة بطريقة شبيهة بنظام DNS، لتسهيل اكتشاف موارد الوكلاء عبر السحب والمؤسسات، من دون نقل البنية القائمة، مع إبقاء ضوابط الوصول والحوكمة محلياً.
- مدفوعات ونماذج: أضافت Amazon Bedrock نموذجي Grok 4.6 وGPT-5.6 مع الاستدلال عبر المناطق. كما أصبحت مدفوعات AgentCore متاحة بصورة عامة، مع تكامل Coinbase ودعم بروتوكول Machine Payment Protocol للمعاملات المستقلة بين الوكلاء. وأطلقت AWS أيضاً Glue 6.0 بخفض سعري قدره 30% ودعم Apache Iceberg v3.
- تمويل ودفاع: سعّرت علي بابا 710 ملايين سهم جديد عند 112.70 دولار هونغ كونغي للسهم، في طرح للمستثمرين خارج الولايات المتحدة. وفي اليابان، تعاقدت ساكانا إيه آي مع وزارة الدفاع لبحث استخدام الوكلاء في جمع المعلومات والتحليل وإدارة المعلومات على المستوى الاستراتيجي، امتداداً لعقد سابق ركز على التنسيق التكتيكي للقيادة والسيطرة.
الخلفية
تستهلك أعباء عمل الوكلاء رموزاً أكثر بكثير من طلبات المحادثة البسيطة، ما يدفع الشركات إلى تخصيص المعالجات وأنظمة الطاقة والكلفة لهذا النمط.
ماذا بعد؟
يُغلق طرح أسهم علي بابا في 26 أغسطس 2026، على أن توجه صافي الحصيلة بالكامل إلى قدرات الذكاء الاصطناعي وبنيتها التحتية.