خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080
كينتينو · خادم الذكاء الاصطناعي المخصص

خادم Kentino AI 64 Rome 5080 3600TOPS - خادم ذكاء اصطناعي اقتصادي مزود بأربع بطاقات رسومات RTX 5080

منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.

€13.030,00السعر لا يشمل ضريبة القيمة المضافة · يتم احتساب تكلفة الشحن عند إتمام عملية الشراء
متوفر في المخزون - يشحن من مستودع الاتحاد الأوروبي
ISO 9001 · أجهزة معتمدةمستودع وضمان الاتحاد الأوروبيأكثر من 7 سنوات في مجال الذكاء الاصطناعي للمؤسساتتم اختبارها قبل الشحن
نظرة عامة
الشحن والضمان

كينتينو AI 64 روما 5080 3600 توبس

خادم بلاكويل اقتصادي بأربعة معالجات رسومات
بطاقة رسومات واحدة RTX 5080 | معالج EPYC Milan | 1676 TOPS INT8

3 600
أفضل 8
64 جيجا بايت
مجموعة ذاكرة الوصول العشوائي للفيديو
4 GPU
بلاكويل
رف
استعداد

خادم بلاكويل ذو الميزانية المحدودة من كينتينو بأربع وحدات معالجة رسومية - مجموعة ذاكرة فيديو بسعة 64 جيجابايت، و3600 إجمالي TOPS INT8، وأقل تكلفة CZK لكل TOPS في المجموعة.

خادم استدلال بلاكويل رباعي المعالجات الرسومية، مبنيٌّ حول بطاقة RTX 5080، يستهلك 360 واط لكل بطاقة، مصنوع من شريحة PCIe 5، بسعة 16 جيجابايت من ذاكرة GDDR7. توفر البطاقات الأربع سعة 64 جيجابايت من ذاكرة الوصول العشوائي للفيديو (VRAM) المجمعة، و3600 تيرابايت من العمليات الحسابية (INT8 TOPS) إجمالاً، بأفضل سعر لكل تيرابايت من الكرونة التشيكية (CZK-per-TOPS) تقدمه كينتينو. يُعد هذا الخادم مدخلاً مثالياً إلى عالم استدلال بلاكويل متعدد المعالجات الرسومية، وهو مناسب لتضمين مجموعات البيانات، وخدمة نماذج تتراوح سعتها بين 7 و13 مليار نموذج على نطاق واسع، وتوليد دفعات من الصور والفيديوهات، ومعالجة متوازية للموترات تصل سعتها إلى 70 مليار نموذج في الربع الرابع (Q4).

أجهزة التبخير

مكون التفاصيل
وحدات معالجة الرسومات 4x NVIDIA GeForce RTX 5080 16 GB GDDR7 (360 واط، PCIe 5.0 x16)
مجموعة ذاكرة الوصول العشوائي للفيديو 64 جيجا بايت
وحدة المعالجة المركزية‏: AMD EPYC 7643 Milan (48 نواة/96 خيط، 225 واط، 128 مسار PCIe 4.0)
اللوحة الأم ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI)
ذاكرة الوصول العشوائي للنظام 256 جيجابايت DDR4-2666 ECC RDIMM (4 × 64 جيجابايت)
صندوق الأمتعة / التخزين 2 تيرابايت NVMe M.2 (PCIe 4.0 x4)
مزود الطاقة وحدة تزويد طاقة واحدة من نوع ATX بقدرة 2 كيلو واط
الهيكل وحدة تثبيت في رف 4U، 4 وحدات معالجة رسومات، رافعات Gen4 x16 سلبية، تدفق هواء موجه من الأمام إلى الخلف
تبريد مبرد SP3 البرجي، 3 مراوح أمامية للسحب 120 مم + مروحة خلفية واحدة للطرد 120 مم (مراوح صناعية)
الانرنيت منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550) + نظام إدارة الإنترنت الذكي (IPMI)

مغلف الطاقة

  • استهلاك وحدة معالجة الرسومات: 4 × 360 واط = 4600 واط
  • إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~1825 واط
  • إجمالي قدرة وحدة التزويد بالطاقة: 2000 واط (وحدة ATX واحدة بقدرة 2 كيلو واط) - هامش أمان بنسبة 11.75%
  • أعلى من الحد الأدنى البالغ 10%، ولكنه أقل صرامة من أجهزة الكمبيوتر الأخرى ذات 4 وحدات معالجة رسومية؛ يوصى بترقية وحدة تزويد الطاقة إلى وحدتين للأحمال عالية الأداء.

طوبولوجيا المسار

تُوزّع وحدة ROMED8-2T أربعة مراوح من الجيل الرابع (4x16) من وحدة المعالجة المركزية. شريحة 5080 هي شريحة PCIe من الجيل الخامس (5) تعمل بنظام الجيل الرابع (x16) دون أي اختناق في عرض النطاق الترددي للاستدلال. لا يوجد مُبدّل PCIe. لا يوجد NVLink - معالجة متوازية للتنبؤات عبر PCIe.

ما يمكنك تشغيله

بفضل 64 جيجابايت من ذاكرة الوصول العشوائي للفيديو المجمعة عبر 4 بطاقات بلاكويل، يتعامل هذا الخادم مع 70 مليار عملية معالجة متوازية باستخدام الموترات في الربع الرابع، وتضمين المجموعات على نطاق واسع، وخطوط أنابيب معالجة الصور والفيديو، وخدمة متعددة المستأجرين من 7 إلى 13 مليار مستخدم متزامن من 64 إلى 128 مستخدمًا.

ماجستير في القانون - نص / استدلال / برمجة

الحدود الصينية

  • Qwen3-32B Q8 (كثيف بجودة قريبة من fp16)؛ Qwen3.5-27B bf16
  • Qwen3-30B-A3B / Qwen3-Coder-30B-A3B لعبة Battlefield 16 (حجمها حوالي 60 جيجابايت) تناسبها تماماً
  • Qwen3.5-122B-A10B الربع الرابع (~70-75 جيجابايت - ضيق، يمكن استخدام ذاكرة الوصول العشوائي DDR4)
  • هونيوان-A13B fp8 (حجم أصلي ~80 جيجابايت - ضيق، يُفضل Q6)
  • Seed-OSS-36B bf16 (~72 جيجابايت مضغوطة)
  • ديب سيك-R2 32B sparse MoE bf16 (~64 GB) (~45-60 tok/s single-stream at Q4 on Blackwell, published reference)
  • GLM-4.5-Air 106B/12B Q3_K (~55 GB) — هامش KV ضيق
  • ERNIE-4.5-47B-A3B الربع الرابع (~28 جيجابايت مع مساحة كافية للطراز الثاني)

الحدود الغربية

  • اللاما 3.3 70 ب Q4_K_M (~43 GB) — النقطة المثالية لهذا المجمع (~30-36 توكا/ثانية تدفق واحد على 4x 5080، مرجع منشور)
  • هيرميس 3 70B / تولو 3 70B الربع الرابع - مشتقات Open Llama بشفافية كاملة بعد التدريب
  • ميسترال صغير 3 / ماجيسترال / ديفسترال صغير 2 24B bf16
  • جيما 3 27 ب bf16 متعدد الأنماط
  • فاي-4 14ب / نيموترون-سوبر 49ب Q6-Q8
  • gpt-oss-20b MXFP4 (16 جيجابايت - 4 مثيلات على 4 بطاقات للمستأجرين المتوازيين)؛ gpt-oss-120b MXFP4 (80 جيجابايت - سعة تخزين محدودة؛ يمكن التحكم في الانسكاب)

الرؤية واللغة

Qwen3-VL-32B / Qwen3-VL-30B-A3B / Qwen3-Omni-30B-A3B; إنترنVL3.5-38B Q6-Q8; Llama 3.2 90B Vision Q4 (~52 جيجابايت)؛ بيكسلال 12B / بيكسلال كبير 124B Q2-Q3؛ جيما 3 27B متعدد الوسائط bf16؛ باليجيما 2 28B bf16; مولمو 72B Q4 (~45 جيجابايت)؛ آية الرؤية 32B bf16.

توليد الصور

FLUX.1 [dev] / [schnell] fp16 — معالجة متوازية للدفعة 4 (حوالي 10-15 ثانية لكل صورة 1024x1024 عند fp8 على Blackwell، مرجع منشور)؛ FLUX.1 Kontext [dev] — تحرير ضمن السياق عبر 4 مستأجرين؛ SD 3.5 Large (18 جيجابايت fp16) — 4 مولدات متوازية؛ SDXL 1.0 + ControlNet + AnimateDiff stacks x 4؛ HunyuanImage-2.1 bf16 لكل بطاقة؛ AuraFlow v0.3 / OmniGen v1 / Kolors 2.0 / PixArt-Sigma.

توليد الفيديو

Wan 2.2 TI2V-5B bf16 على بطاقة واحدة - 4 مستأجرين متوازيين؛ Wan 2.1 14B T2V/I2V Q4-Q6 لكل بطاقة؛ HunyuanVideo 13B Q4 (~30 جيجابايت) tensor-parallel 2-way؛ HunyuanVideo 1.5 (8.3B) bf16 لكل بطاقة؛ Open-Sora 2.0 (11B) Q8 لكل بطاقة - 4 أجيال متوازية؛ CogVideoX-5B int8؛ Mochi-1 Q4 لكل بطاقة.

الصوت / الكلام / تحويل النص إلى كلام

تتضمن كل بطاقة مجموعة كاملة من أنظمة الصوت الغربية والصينية: Whisper v3 + Parakeet + Canary + Moshi + Step-Audio 2 / R1 + CosyVoice 3.0 + Kokoro + Stable Audio Open + MusicGen + AudioGen + SeamlessM4T v2. مع 4 بطاقات، يمكن لكل بطاقة استضافة برنامج صوتي مخصص. يعمل Whisper v3 Turbo بسرعة تصل إلى 50 ضعف السرعة الحقيقية لكل بطاقة (وفقًا للمواصفات المنشورة).

متعدد النماذج / متعدد المستأجرين

حالة الاستخدام المستهدفة. 16 جيجابايت لكل بطاقة تُكافئ أحمال العمل المُقسّمة:

  • مجموعة التضمين: BGE-M3 / Nomic / Jina-embed / E5 / Cohere Embed v3 — 4 مستأجرين بمعدل RPS مرتفع
  • 7-13 مليار خدمة على نطاق واسع: 16-32 مستخدمًا متزامنًا لكل بطاقة عبر vLLM / SGLang؛ 64-128 إجمالي المستخدمين المتزامنين
  • خط أنابيب مختلط: البطاقة 1 = Qwen3-14B + إعادة الترتيب؛ البطاقة 2 = Whisper + Moshi؛ البطاقة 3 = FLUX.1؛ البطاقة 4 = Wan 2.2 TI2V
  • موتر متوازي رباعي الاتجاهات لـ 70B Q4 — Llama 3.3 70B AWQ INT4 عبر 4 بطاقات، ~90-130 tok/s إجمالي الدفعة (مستنبط من اختبار gf-logic 4x4090)

أحمال العمل المستهدفة

  • منصة خدمة ذكاء اصطناعي متعددة وحدات معالجة الرسومات منخفضة التكلفة للشركات الناشئة أو المختبرات في طابق مخصص للنفقات الرأسمالية
  • بنية التضمين + RAG على نطاق أفقي رباعي الاتجاهات
  • مزرعة معالجة الصور/الفيديوهات (الانتشار المستقر/FLUX/Wan 2.2)
  • 7-13 مليار نموذج صغير يخدم على نطاق واسع - 4 مستأجرين مستقلين أو 64-128 مشتركًا متزامنًا
  • صندوق تطوير تجريبي لسير العمل المتوازي للموتر 70B Q4

المراجع المنشورة للأداء

قياسات كينتينو (مرجع 4x4090) + تقديرات 5080 المنشورة

مؤشر نتيجة
مرجع 4x4090: fp16 مستدام 647 TFLOPS
مرجع 4x4090: vLLM Llama 3.3 70B AWQ (الدفعة-32) إجمالي 179.3 توكو/ثانية
المرجع 4x4090: llama.cpp 70B Q4_K_M (مفرد) فك تشفير 20.3 توكوفيرول/ثانية
5080 تقديرًا: لاما 3.3 70B Q4 TP-4 مفرد ~15-20 توكوفيرول/ثانية
5080 تقديرًا: FLUX.1 fp8 لكل بطاقة حوالي 2.2-2.8 ثانية لكل 1024×1024 عند 20 خطوة

معدل نقل بيانات الموتر 5080 ~1.35x 4090 لكل INT8 TOPS؛ فك التشفير أحادي التدفق مقيد بعرض النطاق الترددي للذاكرة (GDDR7 ~960 جيجابايت/ثانية مقابل 4090 ~1008 جيجابايت/ثانية - تقريبًا التكافؤ).

ليست مثالية لـ

  • 70B كثيفة في الربع السادس وما بعده (16 جيجابايت لكل بطاقة كحد أقصى؛ 64 جيجابايت مساحة محدودة للربع السادس)
  • أجهزة MoE الرائدة ذات السياق الطويل (Qwen3-235B، GLM-4.5) - ذاكرة وصول عشوائي للفيديو غير كافية حتى الربع الثاني
  • العمل الحساس لزمن الاستجابة أحادي التدفق على نماذج كبيرة جدًا (تستهلك تكلفة معالجة المعاملات الإضافية بطاقات بسعة 16 جيجابايت)

الضمان ومدة التسليم

2 سنة
ضمان قطع الغيار
عام واحد
ضمان العمل
10-28 أيام
المهلة

تشمل عملية التجميع، وتكوين نظام الإدخال والإخراج الأساسي (BIOS)، وتثبيت برامج التشغيل، واختبار التشغيل الأولي، والتحقق من الوظائف. يعتمد وقت التسليم على توافر المكونات، ويتم تأكيده عند الطلب.

الإضافات الموصى بها

  • قم بترقية وحدة تزويد الطاقة إلى وحدتين متزامنتين من نوع ATX بقدرة 2 كيلو واط - مما يزيد هامش الأمان إلى 55%
  • نفيديا كونيكت اكس-5 100 جيجا بايت MCX555A-ECAT
  • قم بترقية محرك الأقراص الرئيسي إلى محرك أقراص NVMe بسعة 4 تيرابايت
  • قم بترقية ذاكرة الوصول العشوائي (RAM) إلى 384 جيجابايت (6 × 64 جيجابايت) - مما يوفر مساحة أكبر لتشغيل عدة طرازات في وقت واحد
  • وحدة توزيع الطاقة المثبتة على الرف (مزودة بعداد C13/C19) ووحدة تزويد الطاقة غير المنقطعة المتصلة بالشبكة بقدرة 3 كيلو فولت أمبير

يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.

أليس هذا ما تحتاجه بالضبط؟

أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.