كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان
كينتينو · خادم الذكاء الاصطناعي المخصص

كينتينو AI 192 روما L40 1448TOPS — 4 × NVIDIA L40 — EPYC ميلان

منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.

€43.996,00السعر لا يشمل ضريبة القيمة المضافة · يتم احتساب تكلفة الشحن عند إتمام عملية الشراء
متوفر في المخزون - يشحن من مستودع الاتحاد الأوروبي
ISO 9001 · أجهزة معتمدةمستودع وضمان الاتحاد الأوروبيأكثر من 7 سنوات في مجال الذكاء الاصطناعي للمؤسساتتم اختبارها قبل الشحن
نظرة عامة
الشحن والضمان

كينتينو AI 192 روما L40 1448TOPS

خادم استدلال مؤسسي ECC بسعة 192 جيجابايت
4x NVIDIA L40 Passive | EPYC Milan | 2172 TOPS INT8

1 448
أفضل أجهزة INT8
192 جيجا بايت
ذاكرة الفيديو ECC
ECC
مستوى مركز البيانات
24/7
التبريد السلبي

أربع بطاقات بيانات L40 سلبية مزودة بذاكرة ECC. نفس سعة التخزين البالغة 192 جيجابايت الموجودة في 8 بطاقات RTX 4090، ولكنها من فئة مراكز البيانات، ومحمية بذاكرة ECC، ومضمونة من قبل الشركة المصنعة الأصلية.

خادم استدلال يُثبّت في رفّ بحجم 4U، مزوّد بأربع بطاقات NVIDIA L40 سلبية التبريد، مُجمّعة في ذاكرة وصول عشوائي للفيديو ECC بسعة 192 جيجابايت، ومعالج AMD EPYC 7643 Milan (48 نواة/96 خيطًا)، وذاكرة DDR4 ECC بسعة 256 جيجابايت، ووحدة تخزين NVMe بسعة 2 تيرابايت للتشغيل، ووحدتي تزويد طاقة ATX متزامنتين بقدرة 2 كيلو واط. تُعدّ L40 النسخة المُخصصة لمراكز البيانات من RTX 4090، فهي مُبرّدة تبريدًا سلبيًا، ومُجهّزة بتقنية ECC، ومُشفّرات NVENC/NVDEC مُدمجة، وتأتي مع ضمان NVIDIA OEM لمدة 3 سنوات. يدعم تشغيل vLLM وSGLang وllama.cpp وTriton وTensorRT-LLM مُباشرةً.

أجهزة التبخير

مكون التفاصيل
وحدات معالجة الرسومات 4x NVIDIA L40 48 GB ECC GDDR6 (Ada Lovelace، سلبي، 300 واط، فتحة مزدوجة، PCIe 4.0 x16)
مجموعة ذاكرة الوصول العشوائي للفيديو 192 جيجابايت ECC موزعة على 4 بطاقات (لا يوجد NVLink على L40)
وحدة المعالجة المركزية‏: AMD EPYC 7643 Milan (48 نواة/96 خيط، 225 واط، 128 مسار PCIe 4.0)
اللوحة الأم ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI)
ذاكرة الوصول العشوائي للنظام 256 جيجابايت DDR4-2666 ECC RDIMM (4 × 64 جيجابايت)
صندوق الأمتعة / التخزين 2 تيرابايت NVMe M.2 (PCIe 4.0 x4)
مزود الطاقة مزود طاقة مزدوج بقدرة 2 كيلو واط من نوع ATX مع كابل مزامنة
الهيكل وحدة تثبيت في رف 4U مع تدفق هواء موجه من الأمام إلى الخلف
تبريد برج التبريد Arctic Freezer 4U-M SP3 + 3 فتحات تهوية أمامية 120 مم + فتحة عادم خلفية 120 مم
الانرنيت منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550)

مغلف الطاقة

  • استهلاك وحدة معالجة الرسومات: 4 × 300 واط = 4600 واط
  • إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~1825 واط
  • إجمالي قدرة وحدة تزويد الطاقة: 4000 واط (وحدتان متزامنتان بقدرة 2 كيلو واط) - هامش أمان 61.9%
  • وحدة تزويد طاقة مزدوجة لتوزيع الطاقة بشكل منفصل وإمكانية N+1

طوبولوجيا المسار

منفذ PCIe Gen4 x16 لكل بطاقة (L40 يدعم Gen4 بشكل أصلي). اتصال مباشر بين وحدة المعالجة المركزية ووحدة المعالجة المركزية من معالج EPYC واحد - بدون محول PCIe. لا يوجد NVLink - يتم نقل البيانات بين وحدات معالجة الرسومات عبر PCIe نظير إلى نظير. تتوفر ثلاثة منافذ x16 لتوسيع الشبكة/التخزين.

ما يمكنك تشغيله

بفضل ذاكرة الوصول العشوائي للفيديو ECC بسعة 192 جيجابايت موزعة على 4 بطاقات مركز بيانات، يتعامل هذا الخادم مع أكثر من 200 مليار نقطة ربحية في الربع الرابع، وخدمة متعددة المستأجرين للمؤسسات مع اتفاقية مستوى خدمة صارمة، واستدلال إنتاجي على مدار الساعة طوال أيام الأسبوع دون انحراف بتات ECC.

ماجستير في القانون - نص / استدلال / برمجة

الحدود الصينية

  • Qwen3 / Qwen3.5 (علي بابا): Qwen3-235B-A22B Q4 (~132 جيجابايت) مع سياق طويل - التكوين الأساسي (~12-18 توكا/ثانية تدفق واحد عبر 4x L40)؛ Qwen3-Coder-480B-A35B Q2 (~160 جيجابايت، مضغوط)؛ Qwen3.5-122B-A10B fp8 (~75 جيجابايت) مع KV ضخم؛ Qwen3-32B كثيف bf16 تدفقات متزامنة متعددة
  • ديب سيك: DeepSeek-V3/R1/V3.1/V3.2 Q2 (حوالي 215 جيجابايت مع استهلاك طفيف للذاكرة العشوائية)؛ DeepSeek-R2 32B — 4 تدفقات متزامنة، تدفق واحد لكل بطاقة
  • GLM / Z.ai: GLM-4.5 / 4.6 / 4.7 الربع الرابع (~177 جيجابايت) — الخيار الأمثل لهذه الفئة؛ GLM-4.5-Air 106B/12B fp8 أو bf16
  • تينسنت هونيوان: Hunyuan-Large Q3 (~160 جيجابايت) — 389 بايت MoE مع 256 ألف ctx؛ Hunyuan-A13B fp8 (~80 جيجابايت) مع KV ضخم
  • بايدو إيرني-4.5-424B Q3 ​​(~180 جيجابايت)؛ InternVL3.5-241B-A28B Q4 (~135 جيجابايت)؛ Qwen3.5-397B Q3 (~170 جيجابايت)

الحدود الغربية

  • ميتا لاما: لاما 3.3 70B bf16 مع KV هائل (~15-18 توكو/ثانية تيار واحد على 4x L40)؛ لاما 4 سكاوت bf16 (~218 جيجابايت) ضيق؛ لاما 4 مافريك 400B/17B Q3 (~188 جيجابايت)
  • ميسترال: ميسترال لارج 2 / بيكسرال لارج / ديفرسترال 2 123B Q6 (~102 جيجابايت) مريح؛ ميسترال سمول 3 متعدد التدفق
  • OpenAI (الأوزان المفتوحة): gpt-oss-120b MXFP4 (80 جيجابايت) مع KV سخي
  • إنفيديا نيموترون: لاما-3.1-نيموترون ألترا 253 بايت الربع الرابع (~147 جيجابايت)؛ سوبر 49 بايت bf16 تدفقات متعددة
  • جوجل جيما 3: 27B متعدد الوسائط bf16 — تدفقات متعددة مقيمة
  • أخرى: Cohere Command R+ 104B Q6 (~85 جيجابايت)؛ OLMo 3.1 32B؛ Reka Flash 3 21B؛ IBM Granite 4.0 H-Small

نماذج الرؤية واللغة

InternVL3.5-241B-A28B Q4 (~135 جيجابايت)؛ Qwen3-VL-235B-A22B Q4؛ Qwen3-VL-32B bf16؛ Llama 3.2 90B Vision bf16 (~180 جيجابايت)؛ Pixtral Large 124B Q6-bf16؛ Molmo 72B bf16؛ GLM-4.6V 106B fp8؛ Gemma 3 27B multimodal multiple streams؛ InternVL3 78B bf16؛ DeepSeek-VL2 full range.

توليد الصور

FLUX.1 [dev] / [schnell] bf16 مع توليد متزامن (~3-4 ثوانٍ لكل صورة 1024x1024 على L40)؛ FLUX.1 Kontext [dev]؛ أدوات FLUX؛ SD 3.5 Large bf16 x 2-3 متزامن؛ HunyuanImage-2.1 bf16 (~34 جيجابايت) متعدد التدفقات؛ HunyuanImage-3.0 الأساسي (80 بايت MoE، 13 بايت نشط) bf16 (~80 جيجابايت)؛ HunyuanDiT؛ Kolors / Kolors 2.0؛ AuraFlow؛ OmniGen v1؛ PixArt-Sigma.

توليد الفيديو

Wan 2.2 T2V-A14B / I2V-A14B MoE bf16 ثنائي الخبير كامل السياق؛ Wan 2.2 TI2V-5B مسار سريع؛ HunyuanVideo 13B bf16 كلا الخبيرين؛ HunyuanVideo 1.5؛ CogVideoX-5B bf16؛ Open-Sora 2.0 11B bf16؛ Mochi-1 bf16 (~42 جيجابايت) متعدد التدفقات؛ LTX-Video؛ Pyramid Flow؛ SVD / SV3D / SV4D؛ NVIDIA Cosmos Predict 2.

الصوت / الكلام / تحويل النص إلى كلام

  • ASR: Whisper v3 كبير / توربو (حوالي 50 ضعف الوقت الفعلي)؛ Parakeet-TDT؛ Canary 1B؛ Qwen3-ASR؛ SenseVoice
  • تحويل النص إلى كلام: CosyVoice 2/3؛ Kokoro 82M؛ XTTS v2؛ Stable Audio Open؛ Step-Audio-EditX
  • في الوقت الحقيقي / من جهاز لآخر: كيوتاي موشي 7 ب؛ خطوة الصوت 2 ميني/R1؛ Qwen2.5-أومني-7B
  • الموسيقى / المؤثرات الصوتية: MusicGen / AudioGen / Bark؛ SeamlessM4T الإصدار 2

خدمة متعددة النماذج / متعددة المستأجرين

  • بوابة إدارة دورة حياة المنتج للمؤسسات - Qwen3-235B Q4 أو GLM-4.5/4.6 Q4، تخدم من 16 إلى 32 مستخدمًا متزامنًا مع اتفاقية مستوى خدمة صارمة.
  • مجموعة متداخلة من وحدات التخزين المقيمة: 235 بايت MoE + FLUX.1 + Whisper-turbo + Moshi مع ذاكرة فيديو مقسمة وحماية ECC
  • بث فيديو مباشر + خط أنابيب الذكاء الاصطناعي — تقوم أجهزة التشفير NVENC/NVDEC ببث 6-8 خطوط أنابيب متوازية للترجمة والتحرير
  • نظام RAG متعدد المستأجرين - مُضمِّن من جانب الاستعلام + قارئ 70 بايت + مُعيد ترتيب النتائج بزمن استجابة أقل من ثانية واحدة (P99)

أحمال العمل المستهدفة

  • استدلال LLM للإنتاج على مدار الساعة طوال أيام الأسبوع في مجمع 192 جيجابايت (Qwen3-235B Q4، GLM-4.5/4.6/4.7 Q4، Llama 4 Scout bf16)
  • خدمة متعددة المستأجرين للمؤسسات مع اتفاقية مستوى خدمة صارمة - موثوقية ECC على المدى الطويل
  • قاعدة بيانات RAG + vector DB تقدم نماذج استرجاع عالية الجودة ومتزامنة
  • خطوط معالجة الذكاء الاصطناعي للوسائط/الفيديو — مسار الأجهزة NVENC/NVDEC، عرض المؤثرات البصرية، النسخ/الترجمة
  • عمليات نشر مراكز البيانات الصامتة - بطاقات سلبية، مستوى صوتي منخفض بالقرب من مساحة المكتب

الأداء المقاس

المراجع المنشورة | ورقة بيانات NVIDIA L40 + معايير الأداء المجتمعية

مؤشر نتيجة
معدل نقل البيانات لكل بطاقة 8 بت في الثانية (بيانات NVIDIA) 362 TOPS
مجموع نقاط INT8 الأعلى (بطاقتان) 4000 قمة
ذاكرة الوصول العشوائي للفيديو لكل بطاقة ذاكرة GDDR6 بسعة 48 جيجابايت مع تصحيح الأخطاء، وعرض نطاق ترددي 864 جيجابايت/ثانية
لاما 3.3 70B Q6 عبر vLLM (مجتمع) معدل تدفق أحادي من 30 إلى 50 توكو/ثانية، ومعدل تدفق دفعة واحدة من 150 إلى 16 توكو/ثانية فأكثر
FLUX.1 [dev] bf16 على L40 (مجتمعي) حوالي 3-4 ثانية لكل صورة بحجم 1024×1024
NVENC / NVDEC أجهزة تشفير الأجهزة من الجيل الثامن مدمجة في الشريحة (خط أنابيب الذكاء الاصطناعي للفيديو)

البيانات منشورة من مصادر خارجية، ولم يتم قياسها على أجهزة كينتينو. ستنشر كينتينو بياناتها الخاصة بعد أول إصدار للعميل.

ليست مثالية لـ

  • تدريب نماذج كبيرة من الصفر (بدون NVLink، حساب محدود لموتر FP8)
  • استنتاج ميزانية المستخدم الواحد (4x L4 أو 2x L40 أرخص بشكل ملحوظ)
  • Dense bf16 70B at very long context on one model — prefer 2x RTX Pro 6000 Server Edition ( same 192 GB pool, less TP overload)

الضمان ومدة التسليم

2 سنة
ضمان قطع الغيار
عام واحد
ضمان العمل
10-28 أيام
المهلة

ضمان NVIDIA الأصلي لمدة 3 سنوات على معالج L40 بالإضافة إلى ضمان تكامل Kentino. تشمل عملية التجميع: تركيب BIOS، وتثبيت برامج التشغيل، واختبارات التحمل، والتحقق من الأداء. يعتمد وقت التسليم على توفر المكونات، ويتم تأكيده عند الطلب.

الإضافات الموصى بها

  • قم بترقية ذاكرة الوصول العشوائي إلى 512 جيجابايت (أضف 4 × 64 جيجابايت DDR4 - لا تزال هناك أربعة فتحات DIMM متاحة)
  • 4 تيرابايت NVMe لتخزين مكتبة النماذج
  • خزانة رف كاملة بحجم 24U مع وحدة توزيع طاقة مُدارة + وحدة تزويد طاقة غير منقطعة متصلة بالإنترنت بقدرة 5 كيلو فولت أمبير

يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.

أليس هذا ما تحتاجه بالضبط؟

أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.