ذكاء اصطناعي يعمل حيث تُنتَج البيانات، ولا يُرسل شيء.
وصل العتاد قبل الخدمات: الهواتف والحواسيب تشحن اليوم بمعالجات عصبية تشغّل نماذج صغيرة بسرعة تفاعلية، ويتوقع المحللون أن تكون حواسيب الذكاء الاصطناعي أغلب الحواسيب الجديدة هذا العام. قلة قليلة تعرض وضع نموذج يعمل عليها. نحن نفعل.
تبني Zingaro AI الذكاء الاصطناعي على الجهاز وعلى الطرف: نماذج لغوية وصوتية وبصرية صغيرة، مُقطَّرة ومُكمَّمة لتعمل على الهواتف والحواسيب المحمولة ومعالجات NPU وأجهزة الطرف دون اتصال بالسحابة، تُسلَّم أوزاناً وبيئات تشغيل داخل تطبيق العميل أو جهازه، مع مسار هجين إلى نموذج أكبر حين تحتاج المهمة.
- نموذج يعمل على الجهاز الذي تسمّونه، بالكمون والذاكرة والبطارية التي تحددونها، مقيساً هناك.
- أوزان وبيئة تشغيل وكود تكامل داخل تطبيقكم، مع مجموعة التقييم.
- خصوصية بالبناء: البيانات لا تغادر الجهاز إلا إن وجّهتموها.
- مسار هجين للحالات التي لا ينبغي للنموذج الصغير أن يتولاها وحده.
- llama.cpp
- ONNX Runtime
- Core ML
- ExecuTorch
- TensorRT
- Qualcomm AI Engine
- Whisper-class speech models
- Distillation and quantisation toolchains
الذكاء الاصطناعي على الجهاز وعلى الطرف، من البداية إلى النهاية.
- ٠١
اختيار النموذج وتقطيره
أصغر نموذج يؤدي المهمة، مُقطَّر من معلّم أكبر حين تحتاج الدقة، ومُثبَت على مجموعة تقييمكم.
- ٠٢
التكميم والتجميع
INT8 وINT4، والتقليم حين يدفع، والترجمة للهدف: Apple Neural Engine، Qualcomm، معالجات Intel وAMD، Android وiOS، ولينكس المضمّن.
- ٠٣
الكلام على الجهاز
تعرّف على الكلام وتوليده دون اتصال، للتطبيقات والأجهزة التي لا تستطيع الاعتماد على شبكة، باللغات التي يتحدثها مستخدموكم.
- ٠٤
الرؤية على الجهاز
فحص وقراءة وكشف على الكاميرات وصناديق الطرف، حيث إرسال الفيديو إلى السحابة أبطأ أو أغلى أو غير مسموح.
- ٠٥
التوجيه الهجين
الجهاز يعالج الحالة الشائعة؛ غير المؤكد يذهب إلى نموذج أكبر على خوادمكم أو سحابتكم، بالبوابة نفسها.
- ٠٦
التغليف والتحديثات
بيئات تشغيل وملفات نماذج وتحديثات موقَّعة داخل تطبيقكم أو برمجياتكم الثابتة، مع تراجع، وميزانيات ذاكرة وبطارية مقيسة على العتاد الحقيقي.
ما يعود إليكم، وكيف نقيسه.
- نموذج يعمل على الجهاز الذي تسمّونه، بالكمون والذاكرة والبطارية التي تحددونها، مقيساً هناك.
- أوزان وبيئة تشغيل وكود تكامل داخل تطبيقكم، مع مجموعة التقييم.
- خصوصية بالبناء: البيانات لا تغادر الجهاز إلا إن وجّهتموها.
- مسار هجين للحالات التي لا ينبغي للنموذج الصغير أن يتولاها وحده.
- الدقة على مجموعة تقييمكم على الجهاز مقابل النموذج السحابي
- الكمون والإنتاجية على العتاد المستهدف لا على محطة عمل
- حجم النموذج واستهلاك الذاكرة والبطارية لكل مهمة
- نسبة الطلبات المعالَجة على الجهاز مقابل المحوَّلة
الأرقام الحقيقية تأتي من مشروعكم التجريبي. لا ننشر أرقاماً مختلقة.
الأشخاص الذين يشترون هذا العمل عادةً.
- هندسة المنتجات
المدير التقني أو نائب رئيس الهندسة أو رئيس المنتج في شركة برمجيات
ميزة ذكاء اصطناعي وُعد بها العملاء، ونسخة أولى على واجهة نموذج رائد، وفاتورة وزمن استجابة ينموان أسرع من الإيرادات.
اقرأ الصفحة - المنتجات الصوتية
مؤسس منتج صوتي
عرض يعجب المستثمرين، ومشكلة لهجة أو زمن استجابة أو تكلفة للدقيقة تقف بينه وبين أن يصير عملاً تجارياً.
اقرأ الصفحة
ما يسأله الناس عن على الجهاز.
ما الأجهزة التي تستهدفها Zingaro AI؟
تستهدف Zingaro AI هواتف iOS وAndroid، وحواسيب Windows وMac بمعالجات NPU، وأجهزة لينكس المضمّن على الطرف مثل الكاميرات الصناعية والبوابات. يُختار حجم النموذج والتكميم للشريحة المحددة، ويُقاس كل رقم على ذلك العتاد.
ما أصغر نموذج يمكن أن يكون مفيداً؟
لمهمة واحدة ضيقة، يكفي عادةً نموذج بين بضع مئات الملايين وبضعة مليارات من المعاملات، مُقطَّر من معلّم أكبر ومُكمَّم، ليضاهي نموذجاً مستضافاً في تلك المهمة. تثبت Zingaro AI ذلك على مجموعة تقييم العميل قبل الشحن، وتوجّه ما لا يستطيع معالجته إلى نموذج أكبر.
هل الذكاء الاصطناعي على الجهاز أكثر خصوصية؟
نعم بالبناء: المدخل يُعالَج على الجهاز ولا يُرسل شيء ما لم يختر التطبيق إرساله. تصمم Zingaro AI المسار الهجين بحيث لا يغادر الجهاز إلا ما يوافق عليه العميل، وتسجّل ذلك حين يحدث.
أحضروا لنا مهمة على الجهاز التي تؤجلونها.
عشرون دقيقة تكفي لنقول إن كنا نستطيع تولّيها.
يبدأ المشروع التجريبي خلال ٥ أيام عمل من الاتفاق على النطاق · لا دفعة مقدمة · لا تراخيص بالمقعد
