تعلن شركات تصنيع الحواسب الكبرى عن خطوط حواسب محمولة جديدة مع أجهزة تسريع ذكاء اصطناعي مدمجة ومكدسات برمجيات محسّنة لتشغيل الاستدلال مباشرة على الجهاز. يحرك هذا التحول حساب الذكاء الاصطناعي من خوادم السحابة إلى الأجهزة الحدية، مما يمكّن من الذكاء الاصطناعي الذي يحافظ على الخصوصية ويقلل الكمون للتفاعلات المستجيبة للمستخدم.
يتم دفع التحرك من خلال الدفع من جانب العرض (صانعو الشرائح يضيفون حوسبة محددة للذكاء الاصطناعي) والسحب من جانب الطلب (عملاء المؤسسات يريدون أدوات ذكاء اصطناعي قادرة على الاتصال بالإنترنت). تمكّن الحواسب المحمولة مع قدرة LLM على الجهاز المطورين وعمال المعرفة من تشغيل توليد الأكواد وتحليل النصوص والتلخيص دون إرسال البيانات إلى واجهات برمجيات خارجية.
الخصوصية والكمون والتكلفة تصبح الميزة التنافسية. يتفوق نموذج Claude أو Mistral على الجهاز يعمل بكمون 10 ميلي ثانية على استدعاء API سحابي بـ 500 ميلي ثانية. تتنافس شركات مثل Apple (Neural Engine) و Microsoft (Copilot+) و Intel لتعميم استدلال الذكاء الاصطناعي على الجهاز كقدرة حاسوب محمول قياسية.