توفّر Google مجموعة كبيرة من نماذج الذكاء الاصطناعي وواجهات برمجة التطبيقات الرائدة في المجال للاستدلال المستند إلى السحابة الإلكترونية والاستدلال على الجهاز فقط. تتيح لك الاستنتاج المختلط تحقيق توازن سلس بين أحمال عمل الذكاء الاصطناعي على الجهاز المحلي والسحابة الإلكترونية، ما يؤدي إلى تحسين الأداء والتكلفة ومدى التوفّر.
تقدّم الاستدلال المختلط ميزتَين أساسيتَين لتطبيق Android، وهما:
- تحقيق أقصى قدر من الوصول: تعمل النماذج المستندة إلى السحابة الإلكترونية كحلّ احتياطي مهم عندما لا تتوفّر النماذج على الجهاز فقط، مثل Gemini Nano، بسبب قيود على أجهزة الجهاز أو نظام التشغيل. يساعد ذلك في ضمان بقاء ميزات الذكاء الاصطناعي تعمل على أكبر عدد ممكن من أجهزة المستخدمين.
- التكلفة والإمكانات بلا إنترنت: تساعد النماذج على الجهاز فقط في ضمان عمل ميزات الذكاء الاصطناعي بسلاسة عندما يكون المستخدم غير متصل بالإنترنت. بالإضافة إلى ذلك، يساعد تفويض المهام الروتينية إلى الجهاز المحلي في خفض تكاليف الاستدلال على السحابة الإلكترونية.
في ما يلي مزايا الاستنتاج على الجهاز فقط والاستنتاج على السحابة الإلكترونية، على التوالي:
| الاستدلال على الجهاز فقط | الاستنتاج في السحابة الإلكترونية |
|---|---|
| الإتاحة بلا إنترنت | متوافق مع أي جهاز |
| بدون تكلفة استنتاج | إمكانات النماذج المتقدّمة |
خيارات التنفيذ
يمكنك تنفيذ الاستدلال المختلط باستخدام الطرق التالية:
Firebase AI Logic Hybrid API
توفّر واجهة برمجة التطبيقات الهجينة في Firebase AI Logic واجهة واحدة موحّدة لتقسيم الاستنتاج بين بيئات السحابة الإلكترونية والبيئات على الجهاز فقط.
يتضمّن هذا الملف المَعلمة onDeviceConfig التي توفّر عناصر تحكّم لتحديد وضع الاستدلال وإدارة التوجيه:
PREFER_ON_DEVICE: يحاول استخدام النموذج الذي يعمل على الجهاز فقط، مع الرجوع تلقائيًا إلى النموذج المستضاف على السحابة الإلكترونية إذا كان النموذج الذي يعمل على الجهاز غير متاح أو غير متوافق مع الطلب.
PREFER_IN_CLOUD: يحاول استخدام النموذج المستضاف على السحابة الإلكترونية عندما يكون الجهاز متصلاً بالإنترنت والنموذج متاحًا، ولا يعود إلى النموذج المتوفّر على الجهاز إلا إذا كان الجهاز غير متصل بالإنترنت.
ONLY_ON_DEVICE: يحاول استخدام النموذج الذي يعمل على الجهاز فقط، ولكنّه يعرض استثناءً إذا كان غير متاح أو غير متوافق مع الطلب.
ONLY_IN_CLOUD: تحاول استخدام النموذج المستضاف على السحابة الإلكترونية عندما يكون الجهاز متصلاً بالإنترنت والنموذج متاحًا، ويتم عرض استثناء في جميع الحالات الأخرى.
val model = Firebase.ai(backend = GenerativeBackend.Companion.googleAI()) .generativeModel( modelName = "gemini-3.5-flash", onDeviceConfig = OnDeviceConfig(mode = InferenceMode.Companion.PREFER_ON_DEVICE) ) val response = model.generateContent("Write a story about a green robot.") print(response.text)
للاطّلاع على تفاصيل التنفيذ، راجِع مستندات Firebase واستكشِف نموذج الذكاء الاصطناعي المختلط في كتالوج الذكاء الاصطناعي.
التوجيه المخصّص
إذا كان تطبيقك يتضمّن متطلبات محدّدة متعلقة بالنشاط التجاري أو تجربة المستخدم، يمكنك أيضًا تنفيذ منطق توجيه مخصّص. يتيح لك ذلك تحديد مسار الاستنتاج بشكل ديناميكي استنادًا إلى عوامل في الوقت الفعلي، مثل:
- وقت استجابة الشبكة
- سلامة نظام الجهاز (مثل مستويات البطارية وحِمل المعالج)
- مدى تعقيد طلب بحث المستخدم
يتم استخدام نهج الاستدلال المخصّص المختلط هذا من قِبل التطبيقات الرائدة التي نفّذت توجيهًا مخصّصًا خاصًا بها لتقديم تجارب موثوقة قائمة على الذكاء الاصطناعي، بما في ذلك:
GBoard: تستخدم Gboard استدلالاً مخصّصًا مختلطًا لتشغيل أدوات الكتابة، مثل التدقيق اللغوي وإعادة الكتابة.
Kakao Mobility: أنشأت شركة Kakao Mobility أداة لاستخراج الكيانات باستخدام استدلال مخصّص مختلط لخدمة توصيل الطرود، وتعمل هذه الأداة على استخراج أسماء المستلمين والعناوين وأرقام الهواتف تلقائيًا من الرسائل المكتوبة باللغة الطبيعية بهدف تبسيط نماذج الطلبات.