Kentino AI 48 Rome 4090 1322TOPS — 2x RTX 4090 Entry AI Server
منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.
كينتينو AI 48 روما 4090 1322 توبس
خادم ثنائي وحدة معالجة الرسومات بسعة 48 جيجابايت من ذاكرة الوصول العشوائي للفيديو
2x RTX 4090 | EPYC Rome | 2644 TOPS INT8
مجموعة ذاكرة الوصول العشوائي للفيديو بسعة 48 جيجابايت موزعة على اثنين من RTX 4090 - الحد الأدنى للتكلفة للاستدلال المتوازي للموتر من فئة 32B.
خادم ذكاء اصطناعي من فئة محطات العمل Ada مزود بمعالجين رسوميين، مبني على معالج ROMED8-2T / EPYC Rome. يوفر معالجا RTX 4090 سعة ذاكرة فيديو مجمعة تبلغ 48 جيجابايت، مما يتيح تشغيلًا سلسًا لبيانات الفيديو عالية الكثافة 32 بت بتردد Q6-Q8، وHunyuan-A13B بتردد Q6، وفيديو Wan 2.1 بدقة 14 بت، ورؤية Pixtral بدقة 12 بت - وهو أفضل خيار شامل من حيث القيمة مقابل السعر الذي تقدمه سلسلة Kentino، قبل الانتقال إلى Blackwell.
أجهزة التبخير
| مكون | التفاصيل |
|---|---|
| وحدات معالجة الرسومات | 2x NVIDIA GeForce RTX 4090 24 GB GDDR6X (450 واط، PCIe 4.0 x16) |
| مجموعة ذاكرة الوصول العشوائي للفيديو | 48 جيجابايت (بدون NVLink - معالجة متوازية باستخدام Tensor عبر PCIe) |
| وحدة المعالجة المركزية: | AMD EPYC 7542 Rome (32 نواة/64 خيط، 225 واط، 128 مسار PCIe 4.0) |
| اللوحة الأم | ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI) |
| ذاكرة الوصول العشوائي للنظام | 128 جيجابايت DDR4-2666 ECC RDIMM (2 × 64 جيجابايت) |
| صندوق الأمتعة / التخزين | 1 تيرابايت NVMe M.2 (PCIe 4.0 x4) |
| مزود الطاقة | وحدة تزويد طاقة واحدة من نوع ATX بقدرة 2 كيلو واط |
| الهيكل | وحدات رفع سلبية من الجيل الرابع x16 للتركيب على رف 4U |
| تبريد | مبرد SP3 البرجي، 3 مداخل أمامية 120 مم + مخرج خلفي واحد 120 مم |
| الانرنيت | منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550) + نظام إدارة الإنترنت الذكي (IPMI) |
مغلف الطاقة
- استهلاك وحدة معالجة الرسومات: 2 × 450 واط = 900 واط
- إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~1825 واط
- إجمالي قدرة وحدة التزويد بالطاقة: 2000 واط (وحدة ATX واحدة بقدرة 2 كيلو واط) - هامش أمان بنسبة 38.75%
- هامش مريح لوحدة تزويد الطاقة الواحدة
طوبولوجيا المسار
تُخرج وحدة ROMED8-2T مراوح 2x16 مباشرةً من وحدة المعالجة المركزية الرئيسية - بدون مفتاح PLX. لا تحتوي بطاقة Consumer 4090 على NVLink؛ إذ تتواصل تقنية Tensor-Paralel عبر PCIe. منفذ PCIe Gen4 x16 موجود في كلا وحدتي معالجة الرسومات.
ما يمكنك تشغيله
بفضل ذاكرة الوصول العشوائي للفيديو المجمعة بسعة 48 جيجابايت عبر بطاقتين، يتعامل هذا الخادم مع وحدات معالجة الرسومات عالية الكثافة من فئة 32 مليار في الربع السادس إلى الربع الثامن، والأنظمة الرائدة في وزارة التعليم، وإنشاء الصور والفيديو، والذكاء الاصطناعي الكلامي، وخدمة المستأجرين المتعددين.
ماجستير في القانون - نص / استدلال / برمجة
الحدود الصينية
- Qwen3-32B Q6-Q8 كثيف (~25-35 tok/s تدفق واحد على 2x 4090، مرجع منشور)؛ كيو دبليو كيو-32 بي س6؛ Qwen3.5-27B Q6-Q8
- Qwen3-30B-A3B / Qwen3-Coder-30B-A3B bf16 (حجمها حوالي 60 جيجابايت مضغوطة؛ استخدم Q6)
- هونيوان-A13B Q6 أو fp8 (~48 جيجابايت) — 80 بايت/13 بايت MoE، 256 ألف ctx
- Seed-OSS-36B س6 — 512 ألف سياق أصلي
- ديب سيك-R2 32B sparse MoE bf16 (~64 GB tight — prefer Q6 ~45 GB) (~30-40 tok/s single-stream at Q4, published reference)
- ERNIE-4.5-47B-A3B الربع الرابع (حوالي 28 جيجابايت مع مساحة إضافية) / الربع السادس (حوالي 42 جيجابايت)
الحدود الغربية
- اللاما 3.3 70 ب Q4_K_M (~43 GB) tensor-parallel 2-way — النقطة المثالية لهذه الفئة (~14-17 tok/s single-stream on 2x 4090, published reference)
- لاما 4 كشاف 109B/17B MoE Q3_K (~51 GB tight)
- ميسترال صغير 3 / ماجيسترال صغير / ديفسترال صغير 2 (24ب) bf16
- ميكسترال 8x7B Q6
- جيما 3 27 ب bf16؛ فاي-4 14ب bf16
- نيموترون-سوبر 49ب الربع الرابع (~28 جيجابايت)
- أخرى: أولمو 2 32 ب؛ ريكا فلاش 3 21B bf16; فالكون H1R 7B
الرؤية واللغة
Qwen3-VL-32B / Qwen3-VL-30B-A3B MoE / Qwen3-Omni-30B-A3B؛ InternVL3-38B Q4-Q5؛ InternVL3.5-38B؛ DeepSeek-VL2؛ ERNIE-4.5-VL-28B-A3B-Thinking؛ Llama 3.2 11B Vision bf16؛ Pixtral 12B bf16؛ Gemma 3 27B multimodal؛ PaliGemma 2 28B Q4؛ MiniCPM-V 2.6 / MiniCPM-o 2.6.
توليد الصور
FLUX.1 [dev] / [schnell] fp16 (24 جيجابايت) أو fp8 (~12 جيجابايت) مع دفعة كبيرة (~15-25 ثانية لكل صورة 1024x1024 عند fp8 لكل بطاقة، مرجع منشور)؛ FLUX.1 Kontext [dev]؛ SD 3.5 Large (18 جيجابايت fp16)؛ SDXL 1.0 + ControlNet + AnimateDiff؛ HunyuanImage-2.1 bf16 (~34 جيجابايت تناسب المجموعة)؛ AuraFlow v0.3 / OmniGen v1 / Kolors 2.0.
توليد الفيديو
Wan 2.1 14B T2V/I2V Q6/fp8؛ Wan 2.2 TI2V-5B bf16 بطاقة واحدة؛ Wan 2.2 T2V-A14B / I2V-A14B Q4 (~32 جيجابايت)؛ HunyuanVideo 13B Q4-Q5 (~30 جيجابايت)؛ HunyuanVideo 1.5 (8.3B) bf16؛ Open-Sora 2.0 (11B) Q8؛ CogVideoX-5B / 1.5 bf16؛ Mochi-1 Q4-Q8؛ LTX-Video 2B؛ Pyramid Flow 2B.
الصوت / الكلام / تحويل النص إلى كلام
تتسع حزمة البرامج الكاملة بسعة 24 جيجابايت مع مساحة كافية للاستخدام المتزامن: Whisper v3 كبير + Parakeet-TDT + Canary 1B + Moshi + Step-Audio 2 صغير + CosyVoice 3.0 + Kokoro 82M + Stable Audio. افتح جميع البرامج المتبقية في وقت واحد. يعمل Whisper v3 توربو بسرعة 50 ضعف السرعة الحقيقية تقريبًا على بطاقة واحدة (وفقًا للمواصفات المنشورة).
متعدد النماذج / متعدد المستأجرين
- 2-4 مستخدمين متزامنين على وحدات معالجة التعلم من الفئة Q6 ذات 32 بت عبر تقنية vLLM المتوازية باستخدام الموترات
- عبء عمل مختلط: Qwen3-32B Q6 (حوالي 20 جيجابايت) + FLUX.1 fp8 (حوالي 12 جيجابايت) + Whisper-turbo (1.6 جيجابايت) + Moshi (8 جيجابايت) موزعة على بطاقتين
- ضبط دقيق لتقنية LoRA / QLoRA لطرازات 7-14B بشكل مريح، و24-32B بشكل دقيق
أحمال العمل المستهدفة
- محطة عمل ذكاء اصطناعي ثنائية المشغل مع مجموعات مختلطة من التعلم المعزز بالضوء + الصور + الصوت
- نقطة نهاية خدمة من فئة 32B لبيئة تطوير فريق صغير (4-8 مستخدمين متزامنين على Qwen3-32B / Gemma 3 27B)
- إنتاج دفعي لخط أنابيب توليد الصور (FLUX.1 + SD 3.5 + ControlNet)
- صندوق تطوير Video-gen (Wan 2.1 / Wan 2.2 TI2V / HunyuanVideo 1.5)
- صندوق أبحاث الضبط الدقيق لتقنية LoRA / QLoRA لأوزان 7-34B الصينية والغربية
المراجع المنشورة للأداء
مرجع منشور | أجهزة مماثلة لبطاقة RTX 4090 عدد 2
| مؤشر | نتيجة |
|---|---|
| Llama 3.3 70B Q4_K_M فك تشفير llama.cpp | ~14-17 توكوفيرول/ثانية تيار واحد |
| Qwen3-32B Q6 vLLM أحادي التدفق | فك تشفير بمعدل 35-45 توك/ثانية تقريبًا |
| FLUX.1 [dev] fp8 | حوالي 2.5-3.0 ثانية لكل 1024×1024 عند 20 خطوة |
| vLLM batch-32 aggregate (مستنبط من 4x4090) | إجمالي حوالي 90 توكو/ثانية |
تم نشر نقاط مرجعية من أجهزة 2x4090 مماثلة. لم يتم القياس على أجهزة Kentino.
ليست مثالية لـ
- 70B كثيفة في Q6+ (تحتاج إلى 96 جيجابايت من مجموعة الذاكرة - قم بالترقية إلى 4x RTX 4090 أو 4x RTX 5090)
- Frontier 100B+ MoE at bf16 (GLM-4.5, Kimi K2, Mistral Large 3)
الضمان ومدة التسليم
تشمل عملية التجميع، وتكوين نظام الإدخال والإخراج الأساسي (BIOS)، وتثبيت برامج التشغيل، واختبار التشغيل الأولي، والتحقق من الوظائف. يعتمد وقت التسليم على توافر المكونات، ويتم تأكيده عند الطلب.
الإضافات الموصى بها
- نفيديا كونيكت اكس-5 100 جيجا بايت MCX555A-ECAT
- قم بترقية محرك الأقراص الرئيسي إلى محرك أقراص NVMe بسعة 2 تيرابايت
- قم بترقية ذاكرة الوصول العشوائي إلى 256 جيجابايت (4 × 64 جيجابايت) - مساحة أكبر لذاكرة التخزين المؤقت KV لـ MoE ذي السياق الطويل
- وحدة توزيع الطاقة المثبتة على الرف (مزودة بعداد C13/C19) ووحدة تزويد الطاقة غير المنقطعة المتصلة بالشبكة بقدرة 2 كيلو فولت أمبير
الأسئلة التي يطرحها المشترون علينا في أغلب الأحيان قبل طلب خادم.
كم تستغرق عملية الرسم؟
تُشحن الأجهزة المُصنّعة من مكونات متوفرة لدينا بسرعة؛ أما الأجهزة التي تتطلب جيلاً مُحدداً من وحدات معالجة الرسومات (GPU) فيعتمد توفرها على ذلك. نُحدد لك موعداً قبل الدفع، وإذا طرأ أي تغيير، نُبلغك بذلك بدلاً من تركك تكتشف الأمر بنفسك.
هل يمكن تغيير الإعدادات قبل بنائها؟
في أغلب الأحيان. يتم اختيار وحدات معالجة الرسومات والذاكرة والتخزين والتبريد لكل طلب على حدة، والتكوين المذكور هو نقطة انطلاق وليس حزمة ثابتة. إذا كنت بحاجة إلى ذاكرة وصول عشوائي للفيديو أكبر، أو تخزين أسرع، أو نظام تبريد مختلف، فأخبرنا بذلك قبل الطلب وسنقدم لك عرض سعر للتغيير.
هل يمكنني استلام الخادم شخصياً؟
نعم، يمكنك ذلك. يقع مستودعنا في براغ، ونرحب باستلام الطلبات شخصيًا - حيث يستغل معظم الزوار هذه الزيارة لشرح الجهاز لمهندسنا وطرح الأسئلة التي يصعب طرحها عبر البريد الإلكتروني. أما بالنسبة للطلبات داخل جمهورية التشيك، فنحن نسعى جاهدين لتوصيلها شخصيًا وشرح كيفية تركيبها في الموقع.
هل يمكنني التحدث إلى شخص يفهم بالفعل حجم العمل؟
نعم. لدينا مهندس متخصص في أنظمة الذكاء الاصطناعي تحديدًا، وليس موظف مبيعات عام. إذا كان سؤالك يتعلق بأحجام الدُفعات، أو التكميم، أو الربط البيني، أو أين ستكون نقطة الاختناق، فلا تتردد في طرحه - فغالبًا ما تُحسّن هذه المحادثة من إعدادات النظام.
ما هو النموذج الذي يمكنني تشغيله على هذا التكوين؟
نعم. يتم تجميع كل جهاز، واختباره عمليًا، وتقييم أدائه على أحمال عمل حقيقية للذكاء الاصطناعي قبل شحنه، وبذلك نحصل على نظام إدارة التعلم (LLM) مثبت وجاهز للعمل. ما عليك سوى توصيله بالكهرباء، وربطه بشبكتك، والبدء بالعمل - القرار الوحيد المتبقي هو أي مشروع سيتم تشغيله أولًا.
كيف يتم اختبار الخادم قبل شحنه؟
نُجري الاختبارات على أحمال عمل الذكاء الاصطناعي الفعلية بدلاً من النتائج الاصطناعية: معدل نقل البيانات، وسلوك الحمل المستمر، ودرجة الحرارة أثناء التشغيل المتواصل. ستحصل على نتائج الاختبار المعياري مع الجهاز، لذا فإن الأداء الذي وُعدت به هو الأداء الذي يمكنك التحقق منه من اليوم الأول.
هل الخادم جاهز للتشغيل عند وصوله؟
نعم. يتم تجميع كل جهاز، واختباره عمليًا، وتقييم أدائه على أحمال عمل حقيقية للذكاء الاصطناعي قبل شحنه، وبذلك نحصل على نظام إدارة التعلم (LLM) مثبت وجاهز للعمل. ما عليك سوى توصيله بالكهرباء، وربطه بشبكتك، والبدء بالعمل - القرار الوحيد المتبقي هو أي مشروع سيتم تشغيله أولًا.
يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.
أليس هذا ما تحتاجه بالضبط؟
أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.