LLM AI Server with llama.cpp

LLM AI Server with llama.cpp

  • 7.6 MB

    حجم الملف

  • الأمان
  • Everyone

  • Android 7.0+

    Android OS

عن LLM AI Server with llama.cpp

يوفر خادم الذكاء الاصطناعي LLM عناصر تحكم متقدمة في التوليد المحلي باستخدام واجهة برمجة التطبيقات/واجهة المستخدم على الويب.

ذكاء اصطناعي غير محدود، بدون الحاجة إلى الحوسبة السحابية. هاتفك هو الخادم.

شغّل نماذج التعلم الآلي القوية محليًا، بشكل خاص، ومجاني - بواجهة مستخدم بسيطة وسهلة الاستخدام.

يصبح جهاز أندرويد واحد بمثابة خادم الذكاء الاصطناعي الشخصي الخاص بك، والذي يمكن الوصول إليه من أجهزة الكمبيوتر الشخصية، والأجهزة اللوحية، وغيرها من الأجهزة على نفس الشبكة.

---

1. نظرة عامة

خادم الذكاء الاصطناعي لنماذج التعلم الآلي مع llama.cpp هو خادم محلي بالكامل لنماذج التعلم الآلي لنظام أندرويد، يتيح إنشاء النصوص والوسائط المتعددة بشكل خاص ودون اتصال بالإنترنت.

يدعم البحث عن نموذج Hugging Face، وتنزيل ملفات GGUF، وتحميل النماذج محليًا، وفك تشفير MTP التخميني الاختياري لاستنتاج أسرع.

تشمل عائلات النماذج المدعومة: Gemma-4 / Gemma-4 Vision، وQwen / Qwen Vision، وMistral، وLLaMA، وPhi، وBonsai، وغيرها. يتوافق خادم واجهة برمجة التطبيقات (API) المدمج مع واجهات برمجة تطبيقات الرسائل من Ollama وOpenAI وAnthropic (Claude)، موفرًا نقاط نهاية للمحادثة، والإكمال التلقائي، وإنشاء الرسائل، وتضمينها، وتقسيمها إلى رموز/حساب عددها، وعرض نماذجها، مما يسمح لعملاء OpenAI وOllama وClaude الحاليين ومجموعات تطوير البرامج (SDKs) بالاتصال مباشرةً بهاتفك.

تعمل واجهة المستخدم الرسومية المدمجة على نفس المنفذ وتدعم تبديل النماذج، وتعديل المعلمات، وعرض السجلات، وتثبيت تطبيقات الويب التقدمية (PWA).

تتيح ميزتا MCP واستدعاء الدوال سير العمل المُعزز بالأدوات، كما يدعم النظام الإخراج المنظم عبر GBNF وJSON Schema.

---

٢. المستخدمون المستهدفون والأجهزة المدعومة

صُمم هذا النظام للمستخدمين الذين يرغبون في بيئة LLM محلية بالكامل وخاصة:

- المستخدمون الذين يفضلون العمل دون اتصال بالإنترنت

- المطورون الذين يدمجون نظامًا خلفيًا محليًا

- المستخدمون المتقدمون الذين يضبطون أخذ العينات والأداء

- الباحثون الذين يختبرون سلوك الاستدلال

- المستخدمون المهتمون بالخصوصية

يمكن ضبط الأداء من خلال حجم السياق، والخيوط، وحجم الدفعة، وتفريغ وحدة معالجة الرسومات، وتكميم ذاكرة التخزين المؤقت KV، وفك تشفير MTP الاختياري.

... ---

٣. الميزات الرئيسية

- البحث عن صور الوجه المحتضن وتنزيلها باستخدام GGUF

- نموذج الرؤية Qwen3-VL (مضمن افتراضيًا) مع الكشف التلقائي عن جهاز العرض (mmproj)

- توسيع السياق التلقائي (n_ctx) للصور الكبيرة والمطالبات الطويلة

- الرجوع التلقائي من وحدة معالجة الرسومات إلى وحدة المعالجة المركزية عند فشل تهيئة وحدة معالجة الرسومات

- بحث أكثر ذكاءً عن صور الوجه المحتضن: توجيه النموذج/الحجم/الكمية، وتقييم ملاءمة الجهاز، وتنزيل mmproj بنقرة واحدة

- محرك llama.cpp مُحدَّث (b10621، الإصدار 0.3.0) - نماذج أحدث ووحدة معالجة الرسومات Adreno OpenCL

- استرجاع السجلات على الجهاز عبر GET /api/diagnostics

- تحميل GGUF محليًا

- فك تشفير MTP التخميني

- تحكم مفصل في المعلمات (Mirostat، DRY، XTC، Min-p، Typical-p، العقوبات، درجة الحرارة الديناميكية)

- دمج Ollama / OpenAI / خادم واجهة برمجة تطبيقات متوافق مع Anthropic (Claude) Messages

- تضمين واجهة برمجة التطبيقات

- اختيار تلقائي لقوالب الرسائل

- واجهة مستخدم ويب محسّنة تدعم لغات متعددة

- دعم تطبيقات الويب التقدمية (PWA)

- MCP واستدعاء الدوال

- دعم النسخ الاحتياطي واستعادة الملفات الشخصية

نقاط نهاية متوافقة مع Ollama وOpenAI وAnthropic (Claude)؛ القائمة الكاملة في صفحة المُختبِر أدناه.

وثائق واجهة برمجة التطبيقات الكاملة، أمثلة، ومُختبِر تفاعلي:

https://micklab.web.app/llama-tester-en.html

---

4. البدء

يمكنك البدء باستخدام التطبيق فورًا بإحدى الطريقتين التاليتين:

أ) بدء واجهة برمجة التطبيقات/واجهة الويب ← فتح في المتصفح

1. انقر على "بدء واجهة برمجة التطبيقات/واجهة الويب" في الشاشة الرئيسية.

2. انقر على "فتح في المتصفح" لتشغيل واجهة الويب المدمجة.

3. يمكنك الدردشة وتشغيل النموذج مباشرةً من واجهة الويب. ملاحظة: عند الاستخدام الأول، إذا لم يتم تنزيل النموذج بعد، فستقوم واجهة المستخدم الرسومية بتنزيله عند إرسال الرسالة الأولى.

قد يستغرق تنزيل النماذج الكبيرة بعض الوقت.

ب) التشغيل المباشر

1. افتح قسم "التشغيل المباشر" على الشاشة الرئيسية.

2. أدخل نصًا واضغط على "إرسال" لتشغيل النموذج مباشرةً داخل التطبيق.

إذا لم يتم تنزيل النموذج بعد، فسيعرض التطبيق إشعارًا قبل التنزيل.

ج) أو استخدم الإعدادات لإعداد النموذج أولًا

1. افتح الإعدادات.

2. ابحث عن نموذج GGUF في Hugging Face، أو أدخل عنوان URL مباشرًا، أو استورد ملف GGUF محليًا.

3. اضبط المعلمات (حجم السياق، درجة الحرارة، العقوبات، MTP، تفريغ GPU، إلخ).

4. اضغط على "حفظ الإعدادات"، ثم "حفظ وإغلاق" لتحميل النموذج.

5. يمكنك إنشاء نسخة احتياطية من ملف التعريف لاستعادتها لاحقًا.

عرض المزيد

What's new in the latest 1.620

Last updated on 2026-09-06
• Vision: Qwen3‑VL now default; GPU→CPU fallback; improved model search + one‑tap mmproj.
• n_ctx auto‑expands; over‑limit inputs return a clean server error.
• Engine: llama.cpp b10621 / ggml 0.22 with broader model/GPU support.
• Defaults: Chat = Qwen3.5‑2B, Vision = Qwen3‑VL.
• Fixes: missing BOS; streaming continues.
عرض المزيد

فيديوهات ولقطات الشاشة

  • LLM AI Server with llama.cpp الملصق
  • LLM AI Server with llama.cpp تصوير الشاشة 1
  • LLM AI Server with llama.cpp تصوير الشاشة 2
  • LLM AI Server with llama.cpp تصوير الشاشة 3
  • LLM AI Server with llama.cpp تصوير الشاشة 4
  • LLM AI Server with llama.cpp تصوير الشاشة 5
  • LLM AI Server with llama.cpp تصوير الشاشة 6
  • LLM AI Server with llama.cpp تصوير الشاشة 7

معلومات LLM AI Server with llama.cpp APK

احدث اصدار
1.620
الفئة
أعمال
Android OS
Android 7.0+
حجم الملف
7.6 MB
Available on
تقييم المحتوى
Everyone
تقرير الأمان
تحقق الآن
اكتمل فحص الأمان
لا فيروسات
لا برامج تجسس
لا برامج ضارة
لا فيروسات
لا برامج تجسس
لا برامج ضارة
اسم الحزمة:com.micklab.llama
SHA-256:9cc8c04831321cb2cf813b42ce60f4173ee5564175b2c38d4314936d9eeee70a
SHA-1:2f4e28841b71f4665eb94e30a95437995f158470
عرض المزيد
تم التحقق بواسطة: APKPURE
APKPure أيقونة

قم بتنزيل سريع وآمن بالغاية عبر تطبيق APKPure

قم بتثبيت ملفات XAPK/APK بنقرة واحدة على أندرويد!

تحميل APKPure
thank icon
We use cookies and other technologies on this website to enhance your user experience.
By clicking any link on this page you are giving your consent to our Privacy Policy and Cookies Policy.
Learn More about Policies