تخطي إلى معلومات المنتج
1 of 7

Kentino المحدودة

كينتينو AI 192 روما RTXPro6000 4000TOPS — 2× RTX Pro 6000 إصدار خادم بلاكويل — EPYC ميلان

كينتينو AI 192 روما RTXPro6000 4000TOPS — 2× RTX Pro 6000 إصدار خادم بلاكويل — EPYC ميلان

سعر عادي EUR € 34.000,00
سعر عادي سعر البيع EUR € 34.000,00
تخفيضات نفذت الكمية
الشحن يتم احتساب الشحن عند متابعة عملية الشراء.

K-AI 192 Rome RTXPro6000 4000TOPS

زوج بلاكويل فلاجشيب بسعة 192 جيجابايت بتقنية ECC
2x RTX Pro 6000 Server Edition | EPYC Milan | 8000 TOPS INT4

4 000
أفضل أجهزة INT8
192 جيجا بايت
ذاكرة الفيديو ECC
بلاكويل
fp8 الأصلي
2 بطاقة
الحد الأدنى من نقاط التكنولوجيا

بطاقتان سلبيتان من طراز RTX Pro 6000 Blackwell Server Edition - سعة كل منهما 96 جيجابايت ECC. تكلفة معالجة متوازية أقل من تركيبات 4 أو 8 بطاقات. زوج رائد لمراكز البيانات.

خادم استدلال يُثبّت في رفّ بحجم 4U، مزوّد ببطاقتي RTX Pro 6000 Blackwell Server Edition سلبيتين (سعة 96 جيجابايت من نوع ECC GDDR7 لكل بطاقة)، ​​ومعالج AMD EPYC 7643 Milan (48 نواة/96 خيطًا)، وذاكرة DDR4 ECC بسعة 256 جيجابايت، ووحدة تخزين NVMe بسعة 2 تيرابايت للتشغيل، ووحدة تزويد طاقة ATX واحدة بقدرة 2 كيلو واط. بالنسبة لخوارزميات bf16 ذات الكثافة 70B وخوارزميات MoE متوسطة الحجم، يُفضّل استخدام عدد أقل من البطاقات الكبيرة على استخدام عدد أكبر من البطاقات الصغيرة، حيث يتميّز التوازي الموتري باستخدام بطاقتين بأقل قدر من تكاليف الاتصال، وتحمل كل بطاقة بسعة 96 جيجابايت نسخة كاملة من معظم النماذج.

أجهزة التبخير

مكون التفاصيل
وحدات معالجة الرسومات 2x NVIDIA RTX Pro 6000 Blackwell Server Edition 96 GB ECC GDDR7 (سلبي، 600 واط، PCIe 5.0 x16، فتحة مزدوجة)
مجموعة ذاكرة الوصول العشوائي للفيديو بطاقة ذاكرة ECC سعة 192 جيجابايت (96 جيجابايت × 2) - تحتوي كل بطاقة على ذاكرة مستقلة من طراز bf16 سعة 70 بايت
وحدة المعالجة المركزية‏: AMD EPYC 7643 Milan (48 نواة/96 خيط، 225 واط، 128 مسار PCIe 4.0)
اللوحة الأم ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI)
ذاكرة الوصول العشوائي للنظام 256 جيجابايت DDR4-2666 ECC RDIMM (4 × 64 جيجابايت)
صندوق الأمتعة / التخزين 2 تيرابايت NVMe M.2 (PCIe 4.0 x4)
مزود الطاقة وحدة تزويد طاقة ATX واحدة بقدرة 2 كيلو واط
الهيكل وحدة تثبيت في رف 4U مع تدفق هواء موجه من الأمام إلى الخلف
تبريد برج التبريد Arctic Freezer 4U-M SP3 + 3 فتحات تهوية أمامية 120 مم + فتحة عادم خلفية 120 مم
الانرنيت منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550)

مغلف الطاقة

  • استهلاك وحدة معالجة الرسومات: 2 × 600 واط = 4600 واط
  • إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~1825 واط
  • إجمالي قدرة وحدة تزويد الطاقة: 2000 واط (وحدة واحدة بقدرة 2 كيلو واط) - هامش أمان بنسبة 23.7%
  • وحدة تزويد طاقة واحدة كافية؛ ترقية اختيارية بوحدتي تزويد طاقة لتحقيق التكرار N+1

طوبولوجيا المسار

منفذ PCIe Gen4 x16 لكل وحدة معالجة رسومية (البطاقة تدعم Gen5 بشكل أصلي؛ لوحة Rome تدعم Gen4 كحد أقصى). اتصال مباشر بين المعالج واللوحة الأم - بدون محول PCIe. لا يوجد NVLink - اتصال مباشر بين وحدات المعالجة الرسومية. خمس فتحات x16 متاحة للتوسعة. الفرق بين Gen4 و Gen5 ضئيل جدًا عند هذه الكثافة العالية لذاكرة الوصول العشوائي للفيديو.

ما يمكنك تشغيله

بفضل ذاكرة الفيديو ECC بسعة 192 جيجابايت على بطاقتي Blackwell فقط مع دعم أصلي لـ fp8/fp4، يُعد هذا المسار الأمثل لتحقيق كثافة عالية تبلغ 70 بايت عند bf16 وMoE متوسط ​​الحجم. مساران مستقلان بسعة 70 بايت - واحد لكل بطاقة - أو MoE بسعة 200 بايت موزعة على البطاقتين مع الحد الأدنى من الحمل الزائد ثنائي الاتجاه.

ماجستير في القانون - نص / استدلال / برمجة

الحدود الصينية

  • Qwen3 / Qwen3.5 (علي بابا): Qwen3-235B-A22B Q4 (بسعة 132 جيجابايت تقريبًا) مناسب للعمل مع ملفات ctx طويلة (بمعدل 15-25 tok/ثانية تقريبًا في تدفق واحد عبر بطاقتين)؛ Qwen3-Coder-480B-A35B Q2 (بسعة 160 جيجابايت تقريبًا)؛ Qwen3.5-122B-A10B fp8 (بسعة 75 جيجابايت تقريبًا)؛ Qwen3-32B بكثافة bf16 مع KV ضخم؛ QwQ-32B bf16
  • ديب سيك: DeepSeek-V3/R1 Q2 (~215 جيجابايت مع فائض بسيط في ذاكرة الوصول العشوائي) - يعمل Blackwell بنظام fp8 بشكل أصلي؛ DeepSeek-R2 32B bf16 تدفقان متزامنان (واحد لكل بطاقة)
  • GLM / Z.ai: GLM-4.5 / 4.6 / 4.7 الربع الرابع (~177 جيجابايت) — التكوين الأمثل في هذه الفئة؛ GLM-4.5-Air fp8 أو bf16 مع KV ضخم
  • تينسنت هونيوان: Hunyuan-Large Q3 (~160 جيجابايت) — 389 بايت MoE مع 256 ألف ctx؛ Hunyuan-A13B fp8 أصلي (~80 جيجابايت) مع KV ضخم
  • أخرى: بايدو إيرني-4.5-424B Q3 ​​(~180 جيجابايت)؛ InternVL3.5-241B-A28B Q4 (~135 جيجابايت)؛ MiniMax-M1 Q3 (~180 جيجابايت)

الحدود الغربية

  • ميتا لاما: Llama 3.3 70B bf16 على بطاقة واحدة - تدفقان مستقلان متزامنان بحجم 70 بايت (~20-30 توكا/ثانية لكل تدفق)؛ Llama 4 Scout bf16 (~218 جيجابايت، مضغوطة)؛ Llama 4 Maverick Q3 (~188 جيجابايت)
  • ميسترال: ميسترال لارج 2 / بيكسرال لارج / ديفسترال 2 123B Q6 (~88 جيجابايت) بطاقة واحدة أو bf16 عبر كليهما؛ ميسترال سمول 3 متعدد التدفقات
  • OpenAI (الأوزان المفتوحة): gpt-oss-120b MXFP4 الأصلي (80 جيجابايت) — يناسب بطاقة واحدة، تدفقان متزامنان مستقلان
  • إنفيديا نيموترون: لاما-3.1-نيموترون ألترا 253B الربع الرابع (~147 جيجابايت)؛ سوبر 49B bf16 على بطاقة واحدة
  • أخرى: Cohere Command R+ 104B Q6 (~85 جيجابايت) على بطاقة واحدة؛ Google Gemma 3 27B bf16 تدفقات متزامنة متعددة

نماذج الرؤية واللغة

InternVL3.5-241B-A28B Q4 (~135 جيجابايت)؛ Qwen3-VL-235B-A22B Q4؛ Qwen3-VL-32B bf16 بطاقة واحدة؛ Pixtral Large 124B bf16 أو Q6؛ Llama 3.2 90B Vision bf16 (~180 جيجابايت)؛ Molmo 72B bf16 (~144 جيجابايت)؛ GLM-4.6V 106B fp8؛ Gemma 3 27B متعدد الوسائط x 2-3 تدفقات متزامنة.

توليد الصور

FLUX.1 [dev] bf16 تدفقات متزامنة متعددة؛ FLUX.1 Kontext [dev]؛ أدوات FLUX؛ بطاقة SD 3.5 كبيرة bf16 متزامنة؛ HunyuanImage-2.1 bf16 (~34 جيجابايت) × 2-4 متزامنة؛ HunyuanImage-3.0 الأساسي (80 بايت MoE، 13 بايت نشط) bf16 — يناسب بطاقة واحدة؛ HunyuanDiT؛ Kolors / Kolors 2.0؛ AuraFlow؛ OmniGen v1؛ PixArt-Sigma.

توليد الفيديو

Wan 2.2 MoE ثنائي الخبير bf16 سياق كامل - يناسب بطاقة واحدة، تدفقان توليد متزامنان؛ Wan 2.2 TI2V-5B؛ HunyuanVideo 13B bf16 كلا الخبيرين؛ HunyuanVideo 1.5؛ CogVideoX-5B bf16؛ Open-Sora 2.0 11B bf16؛ Mochi-1 bf16 (~42 جيجابايت)؛ LTX-Video؛ Pyramid Flow؛ SVD / SV3D / SV4D؛ NVIDIA Cosmos Predict 2.

الصوت / الكلام / تحويل النص إلى كلام

  • ASR: Whisper v3 كبير / توربو (حوالي 50 ضعف الوقت الفعلي)؛ Parakeet-TDT؛ Canary 1B؛ Qwen3-ASR؛ SenseVoice
  • تحويل النص إلى كلام: CosyVoice 2/3؛ Kokoro 82M؛ XTTS v2؛ Stable Audio Open؛ Step-Audio-EditX
  • في الوقت الحقيقي / من جهاز لآخر: كيوتاي موشي 7 ب؛ خطوة الصوت 2 ميني/R1؛ Qwen2.5-أومني-7B
  • الموسيقى / المؤثرات الصوتية: MusicGen / AudioGen / Bark؛ SeamlessM4T الإصدار 2

خدمة متعددة النماذج / متعددة المستأجرين

  • تدفقان مستقلان بقيمة 70 مليار - واحد لكل بطاقة، وهو أبسط شكل لعزل المستأجرين
  • ذاكرة كثيفة 70 بايت bf16 + حزمة داعمة — LLM على البطاقة 1، صورة/فيديو/صوت على البطاقة 2
  • 200B MoE عبر البطاقتين - الحد الأدنى من النفقات العامة المتوازية للموتر (تقسيم ثنائي الاتجاه)
  • حدود fp8 الأصلية — عائلة DeepSeek V3، Hunyuan-Large fp8 مع مسارات Blackwell الأصلية

أحمال العمل المستهدفة

  • استدلال كثيف 70 بايت bf16 - بطاقتان متوازيتان موتريًا بأقل قدر من النفقات العامة، أو نموذج واحد لكل بطاقة للبث
  • 100-150 مليار وحدة طاقة في الربع الرابع - الربع السادس (GLM-4.5-Air، Qwen3.5-122B-A10B، Hunyuan-A13B، Llama 4 Scout)
  • الاستدلال الحدودي الأصلي لـ FP8 (عائلة DeepSeek V3، وHunyuan، وLlama 4) - يدعم Blackwell تقنية FP8 بشكل أصلي
  • استوديو توليد الصور والفيديو في bf16 (Wan 2.2 T2V-A14B، HunyuanVideo 13B، FLUX.1 [dev])
  • تحليل المستندات ذات السياق الطويل (MiniMax-M1، Kimi-K2 1.58-bit UD مع خاصية الانسكاب)

الأداء المقاس

المراجع المنشورة | ورقة بيانات NVIDIA RTX Pro 6000 Blackwell Server Edition + معايير الأداء المجتمعية

مؤشر نتيجة
معدل نقل البيانات لكل بطاقة 8 بت في الثانية (بيانات NVIDIA) 4000 قمة
مجموع نقاط INT8 الأعلى (بطاقتان) 4000 قمة
عرض نطاق الذاكرة لكل بطاقة سرعة نقل بيانات تبلغ حوالي 1800 جيجابايت/ثانية، وذاكرة تخزين داخلية من نوع ECC GDDR7 بسعة 96 جيجابايت
لاما 3.3 70B bf16 لكل بطاقة (مجتمعية) 15-25 طن/ثانية للتدفق الأحادي، 60-90 طن/ثانية للدفعة
بطاقة مزدوجة متوازية موتر 70B (مجتمعية) من المتوقع تدفق أحادي يتراوح بين 30 و45 توكا/ثانية
بلاكويل fp8 الأصلي DeepSeek-V3 fp8 و Hunyuan-A13B fp8 يعملان بدون بث bf16

البيانات منشورة من مصادر خارجية، ولم يتم قياسها على أجهزة كينتينو. ستنشر كينتينو بياناتها الخاصة بعد أول إصدار للعميل.

ليست مثالية لـ

  • خدمة متعددة المستأجرين ذات تزامن عالٍ جدًا - توزيع أفضل على عدد أكبر من البطاقات باستخدام 4x L40 أو 6x L4
  • ذاكرة تخزين مؤقتة ثقيلة من نوع KV في سياق طويل جدًا - انتقل إلى K-AI 384 RTXPro6000 8000TOPS
  • التدريب - لا تبيع شركة كينتينو أقمشة NVLink من الفئة H
  • استنتاج الميزانية عند سعة تخزين 192 جيجابايت - 8x RTX 4090 أرخص (مع التضحية بتقنية تصحيح الأخطاء ECC والتبريد السلبي مقابل التكلفة)

الضمان ومدة التسليم

2 سنة
ضمان قطع الغيار
عام واحد
ضمان العمل
10-28 أيام
المهلة

ضمان NVIDIA الأصلي لمدة 3 سنوات على بطاقة RTX Pro 6000 Server Edition بالإضافة إلى ضمان تكامل Kentino. تشمل عملية التجميع، وتكوين BIOS، وتثبيت برامج التشغيل، واختبارات التحمل، والتحقق من الأداء. يعتمد وقت التسليم على توفر المكونات، ويتم تأكيده عند الطلب.

الإضافات الموصى بها

  • قم بالترقية إلى وحدة تزويد طاقة مزدوجة متزامنة بقدرة 2 كيلو واط لتحقيق التكرار N+1
  • قم بترقية ذاكرة الوصول العشوائي إلى 512 جيجابايت (4 فتحات DIMM متاحة)
  • 4 تيرابايت NVMe لمكتبات الأوزان الكبيرة وتجهيز النماذج
  • يمكن توسيع التكوين إلى 4 بطاقات (K-AI 384 RTXPro6000 8000TOPS) - يحتوي الهيكل على سعة فتحات
  • خزانة رفية 24U + وحدة تزويد طاقة غير منقطعة (UPS) متصلة بالإنترنت بقدرة 5 كيلو فولت أمبير
عرض التفاصيل الكاملة