كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090
كينتينو · خادم الذكاء الاصطناعي المخصص

كينتينو AI 64 روما 5090 3352TOPS — خادم بلاكويل AI بمعالجين RTX 5090

منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.

€18.250,00السعر لا يشمل ضريبة القيمة المضافة · يتم احتساب تكلفة الشحن عند إتمام عملية الشراء
متوفر في المخزون - يشحن من مستودع الاتحاد الأوروبي
ISO 9001 · أجهزة معتمدةمستودع وضمان الاتحاد الأوروبيأكثر من 7 سنوات في مجال الذكاء الاصطناعي للمؤسساتتم اختبارها قبل الشحن
نظرة عامة
الشحن والضمان

كينتينو AI 64 روما 5090 3352 توبس

خادم بلاكويل ثنائي وحدة معالجة الرسومات
بطاقة رسومات واحدة RTX 5090 | معالج EPYC Milan | 1676 TOPS INT8

3 352
أفضل 8
64 جيجا بايت
ذاكرة الفيديو GDDR7
fp8
الموتر الأصلي
رف
استعداد

خادم بلاكويل ثنائي وحدة معالجة الرسومات للمبتدئين - ذاكرة وصول عشوائي للفيديو مجمعة بسعة 64 جيجابايت، و3352 عملية حسابية من نوع INT8 في الثانية، ودقة أصلية من نوع fp8. يمثل هذا الخادم ترقية من Ada إلى Blackwell من معالجين 4090.

خادم ذكاء اصطناعي من بلاكويل مزود بمعالجين رسوميين، مبني على معالج ROMED8-2T / EPYC Milan. يوفر معالجا RTX 5090 سعة 64 جيجابايت من ذاكرة الوصول العشوائي للفيديو (VRAM) مع دعم حسابي أصلي لـ fp8 tensor - أي ما يقارب ضعف أداء معالجي RTX 4090 في نفس حجم الهيكل، وهو أول خادم ثنائي المعالجات الرسومية قادر على تشغيل Llama 3.3 70B Q4 و Qwen3.5-122B-A10B Q4 و HunyuanVideo بسلاسة تامة بمعدل bf16 / fp8 مع هامش أمان.

أجهزة التبخير

مكون التفاصيل
وحدات معالجة الرسومات 2x NVIDIA GeForce RTX 5090 32 GB GDDR7 (575 واط، PCIe 5.0 x16، Blackwell)
مجموعة ذاكرة الوصول العشوائي للفيديو 64 جيجا بايت
وحدة المعالجة المركزية‏: AMD EPYC 7643 Milan (48 نواة/96 خيط، 225 واط، 128 مسار PCIe 4.0)
اللوحة الأم ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI)
ذاكرة الوصول العشوائي للنظام 128 جيجابايت DDR4-2666 ECC RDIMM (2 × 64 جيجابايت)
صندوق الأمتعة / التخزين 1 تيرابايت NVMe M.2 (PCIe 4.0 x4)
مزود الطاقة وحدة تزويد طاقة واحدة من نوع ATX بقدرة 2 كيلو واط
الهيكل وحدات رفع سلبية من الجيل الرابع x16 للتركيب على رف 4U
تبريد مبرد SP3 البرجي، 3 مراوح أمامية للسحب 120 مم + مروحة خلفية واحدة للطرد 120 مم (مراوح صناعية)
الانرنيت منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550) + نظام إدارة الإنترنت الذكي (IPMI)

مغلف الطاقة

  • استهلاك وحدة معالجة الرسومات: 2 × 575 واط = 4600 واط
  • إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~1825 واط
  • إجمالي قدرة وحدة التزويد بالطاقة: 2000 واط (وحدة ATX واحدة بقدرة 2 كيلو واط) - هامش أمان بنسبة 26.25%
  • هامش تشغيل مناسب لوحدة تزويد طاقة واحدة؛ يتوفر خيار الترقية إلى وحدتي تزويد طاقة لمزيد من المساحة المتاحة

طوبولوجيا المسار

تُوزّع وحدة ROMED8-2T مروحتين من الجيل الرابع (2x16 Gen4) من وحدة المعالجة المركزية. يُعدّ معالج 5090 من الجيل الخامس (Gen5) الذي يعمل بمروحة من الجيل الرابع (Gen4 x16) دون أي تأثير سلبي على عرض النطاق الترددي للاستدلال. لا يوجد مُبدّل PCIe. لا يوجد NVLink في GeForce 5090 - يستخدم نظام Tensor-Paralel ثنائي الاتجاه P2P تقنية PCIe.

ما يمكنك تشغيله

بفضل 64 جيجابايت من ذاكرة GDDR7 VRAM المجمعة عبر بطاقتي Blackwell، يتعامل هذا الخادم مع 70 مليار عملية متوازية باستخدام Tensor-parallel، وأجهزة MoE الرائدة، وتوليد الصور الأصلي fp8، والذكاء الاصطناعي للفيديو، والخدمة المتزامنة متعددة النماذج.

ماجستير في القانون - نص / استدلال / برمجة

الحدود الصينية

  • Qwen3-32B Q8 / bf16 (جودة قريبة من fp16) (~40-55 tok/s تدفق واحد على Blackwell fp8، مرجع منشور)
  • كيو دبليو كيو-32 بي bf16؛ Qwen3-30B-A3B / Coder-30B-A3B bf16 (حجمها حوالي 60 جيجابايت)
  • Qwen3.5-122B-A10B الربع الرابع (حوالي 70-75 جيجابايت مع فائض ذاكرة الوصول العشوائي) - يناسب ذلك هاتف MoE الرائد في الربع الرابع
  • هونيوان-A13B fp8 (~80 جيجابايت بشكل مكثف) أو Q6 (~36 جيجابايت بشكل مريح)
  • Seed-OSS-36B bf16 (حجمها حوالي 72 جيجابايت مضغوطة - يُفضل fp8 بحجم حوالي 36 جيجابايت)
  • ديب سيك-R2 32B sparse MoE bf16
  • GLM-4.5-Air 106B/12B Q4_K_M (~60 جيجابايت) — وزارة التعليم مع هامش أمان
  • ERNIE-4.5-47B-A3B Q6-Q8

الحدود الغربية

  • اللاما 3.3 70 ب Q4_K_M (~43 GB) — عبء العمل الرئيسي لهذه الفئة (~20-28 توكا/ثانية تدفق واحد على 2x 5090، مرجع منشور)
  • هيرميس 3 70B / تولو 3 70B الربع الرابع - مشتقات لاما المفتوحة بعد التدريب
  • ميسترال صغير 3 / ماجيسترال / ديفسترال صغير 2 24B bf16؛ ميكسترال 8x7B bf16
  • جيما 3 27 ب لعبة Battlefield 16 متعددة الوسائط + مساحة التفكير
  • فاي-4 14ب bf16؛ نيموترون-سوبر 49ب Q6-Q8
  • gpt-oss-20b MXFP4 (16 جيجابايت) + gpt-oss-120b MXFP4 (80 جيجابايت - تتناسب بإحكام مع حجم ctx قصير)
  • OLMo 2 32B / OLMo 3.1-32B-Think bf16

الرؤية واللغة

Qwen3-VL-32B / Qwen3-VL-30B-A3B / Qwen3-Omni-30B-A3B bf16; إنترنVL3.5-38B bf16; Llama 3.2 90B Vision Q4 (~52 جيجابايت)؛ بيكسلال 12B bf16; Pixtral Large 124B Q3 ​​(~58 جيجابايت ضيق)؛ جيما 3 27B متعدد الوسائط bf16؛ باليجيما 2 28B bf16; مولمو 72B Q4 (~45 جيجابايت).

توليد الصور

يُعدّ استخدام 5090 الأصلي بتقنية fp8 عاملاً مهماً في السرعة، حيث تعمل برامج FLUX.1 وSD 3.5 وHunyuanImage بشكل أسرع بكثير من Ada: FLUX.1 [dev] / [schnell] fp8 الأصلي (~12 جيجابايت) مع معالجة متوازية مضاعفة عبر البطاقات (~8-12 ثانية لكل صورة 1024×1024 على Blackwell، وفقًا لمرجع منشور)؛ FLUX.1 Kontext [dev]؛ SD 3.5 Large (18 جيجابايت fp16 أو 11 جيجابايت fp8)؛ SDXL 1.0؛ HunyuanImage-2.1 bf16 (~34 جيجابايت)؛ HunyuanImage-3.0 NF4؛ AuraFlow v0.3 / OmniGen v1 / Kolors 2.0.

توليد الفيديو

Wan 2.2 T2V-A14B / I2V-A14B bf16 (إجمالي ~54 جيجابايت) - MoE ثنائي الخبير بدقة كاملة؛ Wan 2.2 TI2V-5B bf16 لكل بطاقة، مستأجران متوازيان؛ HunyuanVideo 13B Q4-Q5 (~30 جيجابايت)، fp8 ضيق؛ HunyuanVideo 1.5 (8.3B) bf16 لكل بطاقة؛ Open-Sora 2.0 (11B) bf16؛ CogVideoX-5B / 1.5 bf16؛ Mochi-1 bf16 (~42 جيجابايت مناسبة)؛ LTX-Video 2B؛ NVIDIA Cosmos Predict 2.

الصوت / الكلام / تحويل النص إلى كلام

تتضمن حزمة معالجة الصوت الصينية والغربية الكاملة نفسها الموجودة في فئة 4090، مع هامش أداء أكبر: Whisper v3 + Parakeet + Canary + Moshi + Step-Audio 2 / R1 + CosyVoice 3.0 + Kokoro + Stable Audio Open + MusicGen + AudioGen + SeamlessM4T v2 + MMS. على معالج 5090 الأصلي بتقنية fp8، يتم فك تشفير Whisper / Parakeet بمعدل زمني أعلى بكثير. يعمل Whisper v3 Turbo بسرعة تقارب 75 ضعفًا من السرعة الحقيقية على معالج Blackwell (وفقًا للمواصفات المنشورة).

متعدد النماذج / متعدد المستأجرين

  • مجموعة البرامج المقيمة: Llama 3.3 70B Q4 (حوالي 43 جيجابايت من المعالجة المتوازية ثنائية الاتجاه باستخدام Tensor) + FLUX.1 fp8 (حوالي 12 جيجابايت) + Whisper-turbo + Moshi
  • 2-4 مستأجرين متزامنين في فئة 32B بسعر Q6-Q8 لكل بطاقة
  • ضبط دقيق لتقنية LoRA / QLoRA من 7 إلى 14B بشكل مريح، ومن 24 إلى 32B بشكل محكم

أحمال العمل المستهدفة

  • محطة عمل مطورين لفريق صغير مع هامش خدمة 70 مليار دولار أمريكي للربع الرابع
  • جهاز Blackwell متطور من جهاز مزود ببطاقتي RTX 4090 - نفس الهيكل، أداء أعلى بحوالي 2.5 مرة، يدعم 8 نقاط عائمة أصلية
  • محطة عمل لإنشاء الصور/الفيديوهات مع تسريع أصلي بتقنية FLUX fp8
  • صندوق متعدد النماذج يعمل في وقت واحد: 70B Q4 + FLUX + Whisper + Moshi مقيم في وقت واحد
  • 4-8 نقاط نهاية استدلال مستخدم متزامنة لنماذج التعلم الخطي من الفئة 32 بايت

المراجع المنشورة للأداء

مرجع منشور | أجهزة مماثلة لبطاقة RTX 5090 عدد 2

مؤشر نتيجة
Llama 3.3 70B Q4_K_M فك تشفير llama.cpp ~20-28 توكوفيرول/ثانية تيار واحد
Qwen3-32B Q8 vLLM أحادي التدفق فك تشفير بسرعة 45-60 توك/ثانية تقريبًا باستخدام FP8
FLUX.1 [dev] fp8 native Blackwell حوالي 1.5-1.9 ثانية لكل 1024×1024 عند 20 خطوة
HunyuanVideo 13B Q5 TP-2 5 ثوانٍ بدقة 720 بكسل في حوالي 5-7 دقائق

نُشرت النتائج، ولم تُقاس على جهاز كينتينو. أما القياس المرجعي الذي أجراه كينتينو على 4x RTX 4090 فكان: 647 تيرافلوب fp16، و179 توك/ثانية للدفعة المجمعة 32.

ليست مثالية لـ

  • نماذج كثيفة بحجم 100 مليار+ في bf16 (DeepSeek-V3، Kimi K2، Mistral Large 3 - تحتاج إلى مساحة تخزين 256+ جيجابايت)
  • إنتاج فيديو Frontier بدقة كاملة طويلة في bf16

الضمان ومدة التسليم

2 سنة
ضمان قطع الغيار
عام واحد
ضمان العمل
10-28 أيام
المهلة

تشمل عملية التجميع، وتكوين نظام الإدخال والإخراج الأساسي (BIOS)، وتثبيت برامج التشغيل، واختبار التشغيل الأولي، والتحقق من الوظائف. يعتمد وقت التسليم على توافر المكونات، ويتم تأكيده عند الطلب.

الإضافات الموصى بها

  • نفيديا كونيكت اكس-5 100 جيجا بايت MCX555A-ECAT
  • قم بترقية محرك الأقراص الرئيسي إلى محرك أقراص NVMe بسعة 2 تيرابايت أو 4 تيرابايت
  • ترقية ذاكرة الوصول العشوائي إلى 256 جيجابايت (4 × 64 جيجابايت) - مساحة تخزين مؤقتة لـ MoE KV / خدمة متزامنة متعددة النماذج
  • وحدة توزيع الطاقة المثبتة على الرف (مزودة بعداد C13/C19) ووحدة تزويد الطاقة غير المنقطعة المتصلة بالشبكة بقدرة 3 كيلو فولت أمبير

يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.

أليس هذا ما تحتاجه بالضبط؟

أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.