Kentino AI 48 Rome 4090 1322TOPS — 2x RTX 4090 Entry AI Server
منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.
كينتينو AI 48 روما 4090 1322 توبس
خادم ثنائي وحدة معالجة الرسومات بسعة 48 جيجابايت من ذاكرة الوصول العشوائي للفيديو
2x RTX 4090 | EPYC Rome | 2644 TOPS INT8
مجموعة ذاكرة الوصول العشوائي للفيديو بسعة 48 جيجابايت موزعة على اثنين من RTX 4090 - الحد الأدنى للتكلفة للاستدلال المتوازي للموتر من فئة 32B.
خادم ذكاء اصطناعي من فئة محطات العمل Ada مزود بمعالجين رسوميين، مبني على معالج ROMED8-2T / EPYC Rome. يوفر معالجا RTX 4090 سعة ذاكرة فيديو مجمعة تبلغ 48 جيجابايت، مما يتيح تشغيلًا سلسًا لبيانات الفيديو عالية الكثافة 32 بت بتردد Q6-Q8، وHunyuan-A13B بتردد Q6، وفيديو Wan 2.1 بدقة 14 بت، ورؤية Pixtral بدقة 12 بت - وهو أفضل خيار شامل من حيث القيمة مقابل السعر الذي تقدمه سلسلة Kentino، قبل الانتقال إلى Blackwell.
أجهزة التبخير
| مكون | التفاصيل |
|---|---|
| وحدات معالجة الرسومات | 2x NVIDIA GeForce RTX 4090 24 GB GDDR6X (450 واط، PCIe 4.0 x16) |
| مجموعة ذاكرة الوصول العشوائي للفيديو | 48 جيجابايت (بدون NVLink - معالجة متوازية باستخدام Tensor عبر PCIe) |
| وحدة المعالجة المركزية: | AMD EPYC 7542 Rome (32 نواة/64 خيط، 225 واط، 128 مسار PCIe 4.0) |
| اللوحة الأم | ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI) |
| ذاكرة الوصول العشوائي للنظام | 128 جيجابايت DDR4-2666 ECC RDIMM (2 × 64 جيجابايت) |
| صندوق الأمتعة / التخزين | 1 تيرابايت NVMe M.2 (PCIe 4.0 x4) |
| مزود الطاقة | وحدة تزويد طاقة واحدة من نوع ATX بقدرة 2 كيلو واط |
| الهيكل | وحدات رفع سلبية من الجيل الرابع x16 للتركيب على رف 4U |
| تبريد | مبرد SP3 البرجي، 3 مداخل أمامية 120 مم + مخرج خلفي واحد 120 مم |
| الانرنيت | منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550) + نظام إدارة الإنترنت الذكي (IPMI) |
مغلف الطاقة
- استهلاك وحدة معالجة الرسومات: 2 × 450 واط = 900 واط
- إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~1825 واط
- إجمالي قدرة وحدة التزويد بالطاقة: 2000 واط (وحدة ATX واحدة بقدرة 2 كيلو واط) - هامش أمان بنسبة 38.75%
- هامش مريح لوحدة تزويد الطاقة الواحدة
طوبولوجيا المسار
تُخرج وحدة ROMED8-2T مراوح 2x16 مباشرةً من وحدة المعالجة المركزية الرئيسية - بدون مفتاح PLX. لا تحتوي بطاقة Consumer 4090 على NVLink؛ إذ تتواصل تقنية Tensor-Paralel عبر PCIe. منفذ PCIe Gen4 x16 موجود في كلا وحدتي معالجة الرسومات.
ما يمكنك تشغيله
بفضل ذاكرة الوصول العشوائي للفيديو المجمعة بسعة 48 جيجابايت عبر بطاقتين، يتعامل هذا الخادم مع وحدات معالجة الرسومات عالية الكثافة من فئة 32 مليار في الربع السادس إلى الربع الثامن، والأنظمة الرائدة في وزارة التعليم، وإنشاء الصور والفيديو، والذكاء الاصطناعي الكلامي، وخدمة المستأجرين المتعددين.
ماجستير في القانون - نص / استدلال / برمجة
الحدود الصينية
- Qwen3-32B Q6-Q8 كثيف (~25-35 tok/s تدفق واحد على 2x 4090، مرجع منشور)؛ كيو دبليو كيو-32 بي س6؛ Qwen3.5-27B Q6-Q8
- Qwen3-30B-A3B / Qwen3-Coder-30B-A3B bf16 (حجمها حوالي 60 جيجابايت مضغوطة؛ استخدم Q6)
- هونيوان-A13B Q6 أو fp8 (~48 جيجابايت) — 80 بايت/13 بايت MoE، 256 ألف ctx
- Seed-OSS-36B س6 — 512 ألف سياق أصلي
- ديب سيك-R2 32B sparse MoE bf16 (~64 GB tight — prefer Q6 ~45 GB) (~30-40 tok/s single-stream at Q4, published reference)
- ERNIE-4.5-47B-A3B الربع الرابع (حوالي 28 جيجابايت مع مساحة إضافية) / الربع السادس (حوالي 42 جيجابايت)
الحدود الغربية
- اللاما 3.3 70 ب Q4_K_M (~43 GB) tensor-parallel 2-way — النقطة المثالية لهذه الفئة (~14-17 tok/s single-stream on 2x 4090, published reference)
- لاما 4 كشاف 109B/17B MoE Q3_K (~51 GB tight)
- ميسترال صغير 3 / ماجيسترال صغير / ديفسترال صغير 2 (24ب) bf16
- ميكسترال 8x7B Q6
- جيما 3 27 ب bf16؛ فاي-4 14ب bf16
- نيموترون-سوبر 49ب الربع الرابع (~28 جيجابايت)
- أخرى: أولمو 2 32 ب؛ ريكا فلاش 3 21B bf16; فالكون H1R 7B
الرؤية واللغة
Qwen3-VL-32B / Qwen3-VL-30B-A3B MoE / Qwen3-Omni-30B-A3B؛ InternVL3-38B Q4-Q5؛ InternVL3.5-38B؛ DeepSeek-VL2؛ ERNIE-4.5-VL-28B-A3B-Thinking؛ Llama 3.2 11B Vision bf16؛ Pixtral 12B bf16؛ Gemma 3 27B multimodal؛ PaliGemma 2 28B Q4؛ MiniCPM-V 2.6 / MiniCPM-o 2.6.
توليد الصور
FLUX.1 [dev] / [schnell] fp16 (24 جيجابايت) أو fp8 (~12 جيجابايت) مع دفعة كبيرة (~15-25 ثانية لكل صورة 1024x1024 عند fp8 لكل بطاقة، مرجع منشور)؛ FLUX.1 Kontext [dev]؛ SD 3.5 Large (18 جيجابايت fp16)؛ SDXL 1.0 + ControlNet + AnimateDiff؛ HunyuanImage-2.1 bf16 (~34 جيجابايت تناسب المجموعة)؛ AuraFlow v0.3 / OmniGen v1 / Kolors 2.0.
توليد الفيديو
Wan 2.1 14B T2V/I2V Q6/fp8؛ Wan 2.2 TI2V-5B bf16 بطاقة واحدة؛ Wan 2.2 T2V-A14B / I2V-A14B Q4 (~32 جيجابايت)؛ HunyuanVideo 13B Q4-Q5 (~30 جيجابايت)؛ HunyuanVideo 1.5 (8.3B) bf16؛ Open-Sora 2.0 (11B) Q8؛ CogVideoX-5B / 1.5 bf16؛ Mochi-1 Q4-Q8؛ LTX-Video 2B؛ Pyramid Flow 2B.
الصوت / الكلام / تحويل النص إلى كلام
تتسع حزمة البرامج الكاملة بسعة 24 جيجابايت مع مساحة كافية للاستخدام المتزامن: Whisper v3 كبير + Parakeet-TDT + Canary 1B + Moshi + Step-Audio 2 صغير + CosyVoice 3.0 + Kokoro 82M + Stable Audio. افتح جميع البرامج المتبقية في وقت واحد. يعمل Whisper v3 توربو بسرعة 50 ضعف السرعة الحقيقية تقريبًا على بطاقة واحدة (وفقًا للمواصفات المنشورة).
متعدد النماذج / متعدد المستأجرين
- 2-4 مستخدمين متزامنين على وحدات معالجة التعلم من الفئة Q6 ذات 32 بت عبر تقنية vLLM المتوازية باستخدام الموترات
- عبء عمل مختلط: Qwen3-32B Q6 (حوالي 20 جيجابايت) + FLUX.1 fp8 (حوالي 12 جيجابايت) + Whisper-turbo (1.6 جيجابايت) + Moshi (8 جيجابايت) موزعة على بطاقتين
- ضبط دقيق لتقنية LoRA / QLoRA لطرازات 7-14B بشكل مريح، و24-32B بشكل دقيق
أحمال العمل المستهدفة
- محطة عمل ذكاء اصطناعي ثنائية المشغل مع مجموعات مختلطة من التعلم المعزز بالضوء + الصور + الصوت
- نقطة نهاية خدمة من فئة 32B لبيئة تطوير فريق صغير (4-8 مستخدمين متزامنين على Qwen3-32B / Gemma 3 27B)
- إنتاج دفعي لخط أنابيب توليد الصور (FLUX.1 + SD 3.5 + ControlNet)
- صندوق تطوير Video-gen (Wan 2.1 / Wan 2.2 TI2V / HunyuanVideo 1.5)
- صندوق أبحاث الضبط الدقيق لتقنية LoRA / QLoRA لأوزان 7-34B الصينية والغربية
المراجع المنشورة للأداء
مرجع منشور | أجهزة مماثلة لبطاقة RTX 4090 عدد 2
| مؤشر | نتيجة |
|---|---|
| Llama 3.3 70B Q4_K_M فك تشفير llama.cpp | ~14-17 توكوفيرول/ثانية تيار واحد |
| Qwen3-32B Q6 vLLM أحادي التدفق | فك تشفير بمعدل 35-45 توك/ثانية تقريبًا |
| FLUX.1 [dev] fp8 | حوالي 2.5-3.0 ثانية لكل 1024×1024 عند 20 خطوة |
| vLLM batch-32 aggregate (مستنبط من 4x4090) | إجمالي حوالي 90 توكو/ثانية |
تم نشر نقاط مرجعية من أجهزة 2x4090 مماثلة. لم يتم القياس على أجهزة Kentino.
ليست مثالية لـ
- 70B كثيفة في Q6+ (تحتاج إلى 96 جيجابايت من مجموعة الذاكرة - قم بالترقية إلى 4x RTX 4090 أو 4x RTX 5090)
- Frontier 100B+ MoE at bf16 (GLM-4.5, Kimi K2, Mistral Large 3)
الضمان ومدة التسليم
تشمل عملية التجميع، وتكوين نظام الإدخال والإخراج الأساسي (BIOS)، وتثبيت برامج التشغيل، واختبار التشغيل الأولي، والتحقق من الوظائف. يعتمد وقت التسليم على توافر المكونات، ويتم تأكيده عند الطلب.
الإضافات الموصى بها
- نفيديا كونيكت اكس-5 100 جيجا بايت MCX555A-ECAT
- قم بترقية محرك الأقراص الرئيسي إلى محرك أقراص NVMe بسعة 2 تيرابايت
- قم بترقية ذاكرة الوصول العشوائي إلى 256 جيجابايت (4 × 64 جيجابايت) - مساحة أكبر لذاكرة التخزين المؤقت KV لـ MoE ذي السياق الطويل
- وحدة توزيع الطاقة المثبتة على الرف (مزودة بعداد C13/C19) ووحدة تزويد الطاقة غير المنقطعة المتصلة بالشبكة بقدرة 2 كيلو فولت أمبير
يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.
أليس هذا ما تحتاجه بالضبط؟
أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.