منذ إصداره الأولي في عام 2022، زودت Text-Generation-Inference (TGI) Hugging Face ومجتمع الذكاء الاصطناعي بحل يركز على الأداء لنشر نماذج اللغات الكبيرة (LLMs) بسهولة. قدمت TGI في البداية حلاً بدون تعليمات برمجية تقريبًا لتحميل النماذج من Hugging Face Hub ونشرها في الإنتاج على وحدات معالجة الرسومات NVIDIA. بمرور الوقت، توسع الدعم ليشمل وحدات معالجة الرسومات AMD Instinct ووحدات معالجة الرسومات Intel وAWS Trainium/Inferentia وGoogle TPU وIntel Gaudi.على مر السنين، ظهرت حلول استدلالية متعددة، بما في ذلك vLLM، وSGLang، وllama.cpp، وTensorRT-LLM، وما إلى ذلك، مما أدى إلى تقسيم النظام البيئي العام. قد تتطلب النماذج والأجهزة وحالات الاستخدام المختلفة واجهة خلفية محددة…
الكاتب: eshraag
لا تزال الشركات التي تستخدم الذكاء الاصطناعي في قرارات التوظيف والفصل تخضع للتدقيق، وهذه المرة هي ميتا تحت المجهر. تزعم شكوى قانونية تم تقديمها في 13 يوليو/تموز في محكمة مقاطعة أمريكية في كاليفورنيا أن شركة ميتا استخدمت أنظمة الذكاء الاصطناعي التي اختارت العمال بشكل غير عادل وغير قانوني لإنهاء خدمتهم أثناء وجودهم في إجازة محمية. يسعى أكثر من عشرين مدعًا مجهولًا إلى إصدار أمر قضائي أولي يمنع الشركة من إنهاء انفصالهم أو تغيير تعويضاتهم أو مزاياهم أو حالة إجازاتهم المحمية. وردت شركة ميتا بأن هذه الادعاءات تفتقر إلى الجدارة وأن قرارات القوى العاملة لديها، ولا تزال، يتخذها الناس، وليس الذكاء…
ياي! يمكن للمنظمات الآن نشر مقالات المدونة
تم الآن دمج البنية التحتية للاستدلال الخاصة بـ FriendliAI في Hugging Face Hub كخيار في زر “نشر هذا النموذج”، مما يؤدي إلى تبسيط وتسريع خدمة نموذج الذكاء الاصطناعي التوليدي. التعاون لتعزيز الابتكار في مجال الذكاء الاصطناعي يعمل برنامج Hugging Face على تمكين المطورين والباحثين والشركات من الابتكار في مجال الذكاء الاصطناعي. أولويتنا المشتركة هي بناء شراكات مؤثرة تعمل على تبسيط سير العمل وتوفير أدوات متطورة لمجتمع الذكاء الاصطناعي. اليوم، يسعدنا أن نعلن عن شراكة بين HF وFriendliAI، الشركة الرائدة في استدلال الذكاء الاصطناعي التوليدي المتسارع، لتعزيز كيفية نشر المطورين لنماذج الذكاء الاصطناعي وإدارتها. يقدم هذا التكامل نقاط نهاية FriendliAI كخيار…
يسعدنا أن نعلن عن إضافتين جديدتين إلى عائلة SmolVLM: SmolVLM-256M وSmolVLM-500M. هذا صحيح — 256 مليون معلمة، مما يجعله أصغر نموذج لغة رؤية في العالم! لقد بنينا على كل ما تعلمناه من SmolVLM 2B مع التركيز على الكفاءة ومزيج البيانات ومقايضات التصميم الجديد. نحن متحمسون لتقديم زوج من النماذج التي تحافظ على الأداء القوي متعدد الوسائط في جزء صغير من البصمة. يأتي هذا الإصدار مزودًا بأربع نقاط تفتيش: نموذجان أساسيان ونموذجان للتعليمات المضبوطة بدقة بأحجام 256 مليونًا و500 مليون معلمة. يمكن تحميل هذه النماذج مباشرة إلى المحولات، MLX وONNX، ولدينا عروض توضيحية للمحولات وWebGPU (مع ONNX). يمكنك العثور على جميع…
ليرة تركية؛ د: يحتوي KVPress على أحدث تقنيات ضغط ذاكرة التخزين المؤقت KV، مما يتيح دورات LLM ذات سياق طويل موفرة للذاكرة. 🚀 إحدى الميزات الرئيسية لنماذج اللغات الكبيرة (LLMs) هي نافذة السياق- الحد الأقصى لعدد الرموز المميزة التي يمكنهم معالجتها في طلب واحد. مع تطور LLMs، أصبحت نوافذ السياق الخاصة بها أكبر بشكل متزايد. تفتح نوافذ السياق الأكبر حجمًا إمكانيات مذهلة: الاسترجاع في السياق: الرجوع بسهولة إلى كميات كبيرة من النص ضمن استعلام واحد. التعلم في السياق: تكييف السلوك مع أمثلة محددة داخل نفس الجلسة. الاستدلال الموسع: التعامل مع سلاسل طويلة جدًا من الأفكار دون كسر السياق. ومع ذلك،…
يا مرائي، أخرج أولا الخشبة من عينك، وحينئذ تبصر جيدا أن تخرج القذى من عين أخيك. متى 7، 3-5 ليرة تركية؛ د لقد أضفنا دعمًا للرؤية إلى smolagents، مما يفتح المجال أمام استخدام نماذج لغة الرؤية في خطوط الأنابيب الوكيلة محليًا. جدول المحتويات ملخص في عالم الوكلاء، يتم إخفاء العديد من القدرات خلف جدار الرؤية. من الأمثلة الشائعة تصفح الويب: تتميز صفحات الويب بمحتوى مرئي غني لا يمكنك استعادته بالكامل بمجرد استخراج النص الخاص بها، سواء كان ذلك الموضع النسبي للأشياء، أو الرسائل المنقولة عبر الألوان، أو أيقونات محددة… في هذه الحالة، تعد الرؤية قوة عظمى حقيقية للعملاء. لذلك أضفنا…
وأشار إلى أن “الأمن القومي هو عامل تسريع الاقتراح في واشنطن وحبوبه السامة في الخارج: فالإطار الذي يفتح البوابة الوحيدة المتاحة في الداخل يدعو العواصم الأجنبية إلى قراءة المؤسسة كأداة للاستراتيجية الأمريكية”. قال: “الخريطة متعددة بالفعل”. “تقوم بروكسل بتفعيل صلاحيات التنفيذ على النماذج ذات الأغراض العامة [starting in August 2026]وتدير لندن معهد أمن الذكاء الاصطناعي، وتمنح بكين التراخيص وفقًا لشروطها الخاصة. أصدرت كاليفورنيا ونيويورك تشريعات للنماذج الحدودية في المنزل. إن الطريق الدائم يتلخص في الأدلة الفنية المشتركة مع الإنفاذ السيادي، والذي يتم ختمه من خلال الاعتراف المتبادل بدلاً من الاحترام، حيث تحتفظ الهند وغيرها من الأسواق غير الغربية الكبرى بحق…
اليوم، نطلق عملية دمج أربعة موفري استدلال رائعين بدون خادم – fal، Replicate، Sambanova، Together AI – مباشرة على صفحات نموذج المركز. كما أنها مدمجة بسلاسة في حزم SDK لعملائنا (لـ JS وPython)، مما يجعل استكشاف الاستدلال بدون خادم لمجموعة واسعة من النماذج التي تعمل على موفري الخدمة المفضلين لديك أسهل من أي وقت مضى. لقد قمنا باستضافة واجهة برمجة تطبيقات Inference بدون خادم على Hub لفترة طويلة (أطلقنا الإصدار الأول في صيف 2020 – واو، الوقت يمر بسرعة 🤯). على الرغم من أن هذا قد أتاح سهولة الاستكشاف وإنشاء النماذج الأولية، فقد قمنا بتحسين عرض القيمة الأساسية الخاص بنا…
يبدو إنشاء جهاز توجيه في وكيلك بمثابة فوز سهل. أرسل طلبات بسيطة إلى نماذج أرخص، أو احجز طلبات باهظة الثمن للمهام الأصعب، أو قم بالتوجيه حسب التخصص – Claude للرمز، وGemini للوسائط المتعددة، وما إلى ذلك. يقوم المصنف أو الاستدلال بإجراء المكالمة، وتنخفض التكاليف، ويظل الأداء مرتفعًا. منتهي. إلا أنها ليست كذلك. تفترض معظم أنظمة التوجيه أن اختيار النموذج يمثل مشكلة تصنيف. في تجربتنا في بناء التوجيه في الأنظمة الوكيلة، فإن ما يبدو وكأنه مشكلة في اختيار النموذج سرعان ما يصبح مشكلة في تحسين الأنظمة. الأبعاد الثلاثة جعلت هذا الأمر صعبًا بالنسبة لنا بشكل مدهش. 1. التكلفة أكثر من مجرد…