التحديث (نوفمبر 2024): التكامل لم يعد متاحًا. يرجى التبديل إلى Hugging Face Inference API، أو Inference Endpoints، أو خيارات النشر الأخرى لتلبية احتياجات نموذج الذكاء الاصطناعي الخاص بك.

اليوم، يسعدنا أن نعلن عن إطلاق النشر على Cloudflare Workers AI، تكامل جديد في Hugging Face Hub. النشر على Cloudflare Workers AI يجعل استخدام النماذج المفتوحة كواجهة برمجة تطبيقات بدون خادم أمرًا سهلاً، مدعومًا بأحدث وحدات معالجة الرسومات المنتشرة في مراكز بيانات Cloudflare edge. بدءًا من اليوم، نقوم بدمج بعض النماذج المفتوحة الأكثر شيوعًا على Hugging Face في Cloudflare Workers AI، المدعومة بحلول الإنتاج لدينا، مثل Text Generation Inference.

باستخدام Deploy on Cloudflare Workers AI، يمكن للمطورين إنشاء تطبيقات ذكاء اصطناعي توليدية قوية دون إدارة البنية التحتية لوحدة معالجة الرسومات والخوادم وبتكلفة تشغيل منخفضة جدًا: ادفع فقط مقابل الحوسبة التي تستخدمها، وليس مقابل السعة الخاملة.

الذكاء الاصطناعي التوليدي للمطورين

تتوسع هذه التجربة الجديدة بناءً على الشراكة الإستراتيجية التي أعلنا عنها العام الماضي لتبسيط الوصول إلى نماذج الذكاء الاصطناعي التوليدي المفتوحة ونشرها. إحدى المشكلات الرئيسية التي يواجهها المطورون والمؤسسات هي ندرة توفر وحدة معالجة الرسومات والتكاليف الثابتة لنشر الخوادم لبدء البناء. يوفر النشر على Cloudflare Workers AI حلاً سهلاً ومنخفض التكلفة لهذه التحديات، مما يوفر وصولاً بدون خادم إلى Hugging Face Models الشهيرة مع نموذج تسعير الدفع لكل طلب.

دعونا نلقي نظرة على مثال ملموس. تخيل أنك تقوم بتطوير تطبيق RAG يتلقى ما يقرب من 1000 طلب يوميًا، مع إدخال 1 ألف رمز مميز وإخراج 100 رمز مميز باستخدام Meta Llama 2 7B. ستصل تكاليف إنتاج استنتاج LLM إلى حوالي 1 دولار في اليوم.

قال جون جراهام كومينغ، المدير التنفيذي للتكنولوجيا في Cloudflare: “نحن متحمسون لجلب هذا التكامل إلى الحياة بهذه السرعة. إن وضع قوة شبكة Cloudflare العالمية من وحدات معالجة الرسومات بدون خادم في أيدي المطورين، مقترنة بالنماذج مفتوحة المصدر الأكثر شيوعًا على Hugging Face، سيفتح الأبواب أمام الكثير من الابتكارات المثيرة من قبل مجتمعنا حول العالم”.

كيف يعمل

يعد استخدام نماذج الوجه المعانقة على Cloudflare Workers AI أمرًا سهلاً للغاية. ستجد أدناه تعليمات خطوة بخطوة حول كيفية استخدام Hermes 2 Pro على Mistral 7B، أحدث طراز من Nous Research.

يمكنك العثور على جميع الطرز المتاحة في مجموعة Cloudflare هذه.

ملاحظة: أنت بحاجة إلى الوصول إلى حساب Cloudflare ورمز API.

يمكنك العثور على خيار Deploy on Cloudflare في جميع صفحات النماذج المتاحة، بما في ذلك النماذج مثل Llama أو Gemma أو Mistral.

بطاقة نموذجية

افتح قائمة “نشر”، وحدد “Cloudflare Workers AI” – سيؤدي هذا إلى فتح واجهة تتضمن تعليمات حول كيفية استخدام هذا النموذج وإرسال الطلبات.

ملاحظة: إذا كان النموذج الذي تريد استخدامه لا يحتوي على خيار “Cloudflare Workers AI”، فهو غير مدعوم حاليًا. نحن نعمل على توسيع مدى توفر النماذج مع Cloudflare. يمكنك التواصل معنا على api-enterprise@huggingface.co بخصوص طلبك.

مقتطف الاستدلال

يمكن استخدام التكامل حاليًا عبر خيارين: استخدام Workers AI REST API أو مباشرة في Workers باستخدام Cloudflare AI SDK. حدد الخيار المفضل لديك وانسخ الرمز إلى بيئتك. عند استخدام REST API، عليك التأكد من أن ACCOUNT_ID و API_TOKEN يتم تعريف المتغيرات.

هذا كل شيء! يمكنك الآن البدء في إرسال الطلبات إلى Hugging Face Models المستضافة على Cloudflare Workers AI. تأكد من استخدام الموجه الصحيح والقالب المتوقع بواسطة النموذج.

لقد بدأنا للتو

نحن متحمسون للتعاون مع Cloudflare لجعل الذكاء الاصطناعي في متناول المطورين. سنعمل مع فريق Cloudflare لتوفير المزيد من النماذج والخبرات لك!

شاركها.
اترك تعليقاً