Sunday, 20 September 2026 | التحديث اليومي نظرة ثاقبة للذكاء الاصطناعي، مكتوبة للبناة

الدروس التعليمية

Step-by-step AI tutorials that assume you want to run something today: installing local model runtimes, sizing hardware, serving APIs and fixing what breaks.

24× — the spread we measured. What Is vLLM? A Practical Guide to.
الدروس التعليمية

ما هو vLLM؟ دليل عملي إلى محرك خدمة نماذج اللغة الكبيرة عالي الإنتاجية

vLLM is an open-source inference engine for serving LLMs on GPUs at high throughput, exposing them through an OpenAI-compatible HTTP API.Its two core techniques — PagedAttention and continuous batching — let one GPU handle many concurrent requests without wasting VRAM.Install with pip install vllm in a fresh Python environment on Linux (NVIDIA GPU, compute capability 7.0+), then start a server with vllm serve <model>.It is built for serving many users or apps.

$0.13 — per million tokens. How to Build a RAG Pipeline (Step.
الدروس التعليمية

كيف تبني خط أنابيب استرجاع-الولادة (RAG) في عام 2026 (خطوة بخطوة)

دليل عملي يركز على الكود خطوة بخطوة لبناء مسار إنتاج مدعوم بالاسترجاع في عام 2026 — بدءًا من التضمينات وتقسيم النص إلى أجزاء وصولاً إلى تخزين المتجهات وإعادة الترتيب والإنتاج، مع ذكر إصدارات الأدوات التي تم التحقق منها وملاحظات صادقة حول ما يثبت فعاليته بالفعل.

2× — the spread we measured. How to Run Llama 3 Locally on.
الدروس التعليمية

كيفية تشغيل نموذج لاما ٣ محليًّا على معالج Snapdragon 8 Gen 4 (دليل تفصيلي خطوة بخطوة، ٢٠٢٦)

يعمل Llama 3 8B 8B بشكل مدهش على هواتف أندرويد الرائدة 2026 - بسرعة قابلة للاستخدام، دون الحاجة إلى الاتصال بالإنترنت، ودون تكاليف واجهة برمجة التطبيقات. إليك بالضبط كيفية إعداده على جهاز Snapdragon 8 Gen 4.

انتقل إلى الأعلى