كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت
كينتينو · خادم الذكاء الاصطناعي المخصص

كينتينو AI 96 روما RTXPro6000 2000TOPS — خادم محطة عمل بلاكويل ببطاقة واحدة سعة 96 جيجابايت

منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.

€20.900,00السعر لا يشمل ضريبة القيمة المضافة · يتم احتساب تكلفة الشحن عند إتمام عملية الشراء
متوفر في المخزون - يشحن من مستودع الاتحاد الأوروبي
ISO 9001 · أجهزة معتمدةمستودع وضمان الاتحاد الأوروبيأكثر من 7 سنوات في مجال الذكاء الاصطناعي للمؤسساتتم اختبارها قبل الشحن
نظرة عامة
الشحن والضمان

كينتينو AI 96 روما RTXPro6000 2000TOPS

خادم محطة عمل ببطاقة واحدة ECC سعة 96 جيجابايت
معالج رسومات واحد RTX Pro 6000 Blackwell | معالج EPYC Milan | 2000 TOPS INT8

2 000
أفضل أجهزة INT8
96 جيجا بايت
ذاكرة الفيديو ECC
عزباء
تصميم البطاقة
fp8
بلاكويل الأصلي

بطاقة واحدة، ذاكرة فيديو ECC بسعة 96 جيجابايت، خط أنابيب بلاكويل الكامل لمعالجة الموترات. 70 بايت من عمليات bf16 الكثيفة على وحدة معالجة رسومية واحدة - بدون أي تكلفة إضافية للمعالجة المتوازية للموترات.

خادم محطة عمل يُثبّت في رفّ بحجم 4U، مزوّد ببطاقة رسومات NVIDIA RTX Pro 6000 Blackwell Workstation واحدة (ذاكرة GDDR7 سعة 96 جيجابايت ECC)، ومعالج AMD EPYC 7643 Milan واحد (48 نواة/96 خيطًا)، وذاكرة DDR4 ECC سعة 256 جيجابايت، وقرص تخزين NVMe بسعة 2 تيرابايت للتشغيل، ووحدة تزويد طاقة ATX بقدرة 2 كيلو واط مع هامش أمان 54%. يأتي Kentino مزودًا بأبسط مسار برمجي - لا يتطلب تهيئة Tensor-Paralel، ولا يدعم تصحيح أخطاء وحدات معالجة الرسومات المتعددة. تعمل برامج vLLM وSGLang وllama.cpp وComfyUI على جهاز واحد بكفاءة عالية.

أجهزة التبخير

مكون التفاصيل
وحدة معالجة الرسوميات‏:‏ 1x NVIDIA RTX Pro 6000 Blackwell Workstation 96 GB ECC GDDR7 (600 واط، PCIe 5.0 x16)
VRAM ذاكرة ECC بسعة 96 جيجابايت على بطاقة واحدة - بدون تجميع، بدون تكلفة إضافية للمعالجة المتوازية باستخدام Tensor
وحدة المعالجة المركزية‏: AMD EPYC 7643 Milan (48 نواة/96 خيط، 225 واط، 128 مسار PCIe 4.0)
اللوحة الأم ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI)
ذاكرة الوصول العشوائي للنظام 256 جيجابايت DDR4-2666 ECC RDIMM (4 × 64 جيجابايت)
صندوق الأمتعة / التخزين 2 تيرابايت NVMe M.2 (PCIe 4.0 x4)
مزود الطاقة وحدة تزويد طاقة ATX واحدة بقدرة 2 كيلو واط
الهيكل وحدة تثبيت على رف 4U (سعة 4 فتحات، واحدة منها مشغولة - مساحة للتوسيع)
تبريد برج التبريد Arctic Freezer 4U-M SP3 + 3 فتحات تهوية أمامية 120 مم + فتحة عادم خلفية 120 مم
الانرنيت منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550)

مغلف الطاقة

  • استهلاك وحدة معالجة الرسومات: 1 × 600 واط = 600 واط
  • إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~925 واط
  • إجمالي طاقة وحدة التزويد بالطاقة: 2000 واط — 53.8% هامش احتياطي
  • وحدة تزويد طاقة واحدة، وكابلات بسيطة - هامش واسع لبناء بطاقة واحدة

طوبولوجيا المسار

منفذ PCIe Gen4 x16 في وحدة معالجة الرسومات (البطاقة تدعم Gen5 بشكل أصلي؛ لوحة Rome تدعم Gen4 فقط). اتصال مباشر بالمعالج - لا حاجة لمحول PCIe. لا حاجة لتقنية NVLink - بطاقة واحدة، لا يوجد اتصال بين وحدات معالجة الرسومات. ستة منافذ x16 متاحة لبطاقات الشبكة/التخزين/التوسعة.

ما يمكنك تشغيله

بفضل ذاكرة الوصول العشوائي للفيديو ECC بسعة 96 جيجابايت على بطاقة Blackwell واحدة، يتعامل هذا الخادم مع 70B كثيف bf16 على وحدة معالجة رسومات واحدة، ونماذج LLM مفتوحة الوزن، ونماذج الرؤية، وتوليد الصور والفيديو، والذكاء الاصطناعي للكلام، والاستدلال الإنتاجي - لا حاجة إلى تنسيق متوازي للموتر.

ماجستير في القانون - نص / استدلال / برمجة

الحدود الصينية

  • Qwen3 / Qwen3.5 (علي بابا): Qwen3-32B كثيف bf16 (حوالي 65 جيجابايت) مع KV سخي؛ Qwen3-72B Q6 (حوالي 58 جيجابايت، حوالي 25-35 توكا/ثانية تدفق واحد)؛ Qwen3-30B-A3B MoE bf16؛ Qwen3-Coder-30B-A3B وكيل عند 256 ألف سياق؛ Qwen3.5-122B-A10B Q4 (حوالي 70 جيجابايت) مع KV ضيق؛ QwQ-32B bf16 منطقي
  • ديب سيك: DeepSeek-R2 32B sparse MoE bf16 (~64 جيجابايت، 92.7% AIME 2025 بطاقة واحدة)؛ DeepSeek-R1-Distill-Qwen-32B bf16؛ DeepSeek-V2-Lite 16B full precision
  • GLM / Z.ai: GLM-4.5-Air 106B/12B Q4-Q5 (60-70 جيجابايت)؛ GLM-4.6V 106B Q4
  • تينسنت هونيوان: Hunyuan-A13B 80B/13B MoE Q4-fp8 (~48-80 جيجابايت) مع 256 ألف ctx وتقنية الاستدلال ثنائي الوضع
  • بايت دانس Seed-OSS-36B bf16 (~72 جيجابايت مضغوطة) أو fp8 (~36 جيجابايت) مع سياق أصلي كامل بحجم 512 كيلوبايت
  • بايدو ERNIE-4.5-47B-A3B الربع الرابع - الفترة الزمنية الثامنة مع سياق مطول

الحدود الغربية

  • ميتا لاما: لاما 3.3 70B في bf16 (~70 جيجابايت) على بطاقة واحدة مع 8-16 ألف سياق - التكوين الأمثل؛ لاما 3.3 70B Q6 (~58 جيجابايت، ~35-50 توك/ثانية تدفق واحد)؛ لاما 3.1 8B bf16 (~80-120 توك/ثانية)؛ لاما 3.2 90B Vision Q4 (~52 جيجابايت)؛ لاما 4 Scout 109B/17B MoE Q4 (~63 جيجابايت)
  • ميسترال: Mistral Small 3 / Magistral Small 1.2 / Devstral Small 2 (24B) جميعها في bf16 مع 256 ألف ctx؛ Mixtral 8x7B Q6؛ Codestral Mamba 7B؛ Pixtral 12B bf16
  • OpenAI (الأوزان المفتوحة): gpt-oss-20b MXFP4 أصلي (16 جيجابايت)؛ gpt-oss-120b MXFP4 أصلي (80 جيجابايت) — بطاقة واحدة، تدفق واحد
  • جوجل جيما 3: ذاكرة متعددة الأنماط 27 بايت bf16 (~54 جيجابايت) مع 128 ألف ctx؛ ذاكرة 12 بايت / 4 بايت bf16
  • مايكروسوفت فاي-4 14B كثيف bf16؛ فاي-4-الاستدلال؛ فاي-4-متعدد الأنماط
  • إنفيديا نيموترون: Llama-3.1-Nemotron-Super 49B Q6 (~40 جيجابايت)؛ نيموترون نانو 8B
  • أخرى: IBM Granite 4.0 H-Small 32B/9B؛ OLMo 2 32B؛ Reka Flash 3 21B؛ Falcon H1R 7B؛ Command R 35B

نماذج الرؤية واللغة

Qwen3-VL-8B / 32B bf16، Qwen3-VL-30B-A3B MoE bf16، Qwen3-Omni-30B-A3B؛ InternVL3 حتى 78B Q4 (حوالي 48 جيجابايت)؛ InternVL3.5-38B bf16؛ DeepSeek-VL2 كامل النطاق؛ Llama 3.2 11B Vision bf16؛ Llama 3.2 90B Vision Q4 (حوالي 52 جيجابايت)؛ Pixtral 12B bf16؛ Molmo 72B Q4؛ Molmo 7B bf16؛ Gemma 3 12B / 27B متعدد الوسائط؛ PaliGemma 2 28B؛ Phi-3.5-Vision؛ Aya Vision 8B / 32B؛ MiniCPM-V 2.6 / MiniCPM-o 2.6؛ GLM-4.6V.

توليد الصور

FLUX.1 [dev] / [schnell] bf16 (~24 جيجابايت) ومُكمّم (~15-25 ثانية/صورة عند fp8)؛ FLUX.1 Kontext [dev] تحرير في السياق؛ أدوات FLUX (تعبئة / عمق / كاني / ريدكس)؛ SD 3.5 كبير bf16 (~18 جيجابايت)؛ SDXL 1.0؛ HunyuanImage-2.1 bf16 (~34 جيجابايت) بدقة 2K أصلية؛ HunyuanDiT 1.5B؛ Kolors / Kolors 2.0؛ AuraFlow v0.3؛ OmniGen v1؛ PixArt-Sigma.

توليد الفيديو

Wan 2.2 T2V-A14B / I2V-A14B MoE bf16 (~54 جيجابايت، كلا الخبيرين مقيمين)؛ مسار سريع وان 2.2 TI2V-5B؛ HunyuanVideo 13B bf16 (~60-80 جيجابايت، بدقة 720 بكسل)؛ هونيوانفيديو 1.5 (8.3B)؛ com.CogVideoX-5B; مفتوح سورا 2.0 (11B) bf16; جينمو موتشي-1 بف16 (~42 جيجابايت)؛ LTX-فيديو؛ تدفق الهرم؛ سفد / SV3D / SV4D؛ نفيديا كوزموس التنبؤ 2.

الصوت / الكلام / تحويل النص إلى كلام

  • ASR: Whisper v3 كبير / توربو (حوالي 50 ضعف الوقت الفعلي)؛ NVIDIA Parakeet-TDT 1.1B؛ Canary 1B؛ Qwen3-ASR؛ SenseVoice
  • تحويل النص إلى كلام: CosyVoice 2 / Fun-CosyVoice 3.0؛ Kokoro 82M؛ Stable Audio Open؛ Coqui XTTS v2؛ StyleTTS 2؛ Step-Audio-EditX
  • في الوقت الحقيقي / من جهاز لآخر: كيوتاي موشي (200 مللي ثانية، اتصال ثنائي الاتجاه)؛ ستيب-أوديو 2 ميني؛ ستيب-أوديو-R1 / R1.1؛ كوين 2.5-أومني-7B
  • الموسيقى / المؤثرات الصوتية: ميتا ميوزيك جين؛ أوديو جين؛ سونو بارك؛ سيملس إم فور تي الإصدار الثاني

خدمة متعددة النماذج / متعددة المستأجرين

  • مساعد ترميز البث أحادي المستأجر - 70 بايت كثافة bf16، زمن استجابة منخفض، بدون عقوبة TP
  • مجموعة برامج مقيمة مختلطة: Qwen3-32B bf16 + FLUX.1 fp8 + Whisper-turbo + Moshi على بطاقة واحدة مع ذاكرة فيديو مقسمة
  • الضبط الدقيق: LoRA / QLoRA على طرازات 13-34B؛ المعلمات الكاملة على طراز 7B
  • خدمة التضمين: BGE-M3 / E5 / Jina، أحد سكان المنطقة بجوار مولد كهربائي LLM

أحمال العمل المستهدفة

  • مساعد ترميز البث أحادي المستأجر يعمل بنظام Llama 3.3 70B bf16 أو Qwen3-Coder-30B-A3B — بدون تكلفة إضافية لتنسيق TP
  • محطة عمل للمطورين، مناسبة لمهندس واحد أو فريق صغير يحتاج إلى طراز من فئة 70B بسعة 32-128 ألف سياق.
  • مختبر توليد الفيديو أو الصور — HunyuanVideo 13B، وWan 2.2 ثنائي الخبرة، وHunyuanImage-2.1، جميعها في bf16 resident
  • وحدة معالجة الصور/التعرف الضوئي على الأحرف (VLM/OCR) — Qwen3-VL-32B bf16 أو InternVL3.5-38B مع مسارات معالجة المستندات الطويلة
  • جهاز نظيف لبوابة واجهة برمجة تطبيقات LLM صغيرة - نموذج واحد، بطاقة واحدة، عمليات سهلة

الأداء المقاس

المراجع المنشورة | ورقة بيانات NVIDIA RTX Pro 6000 Blackwell + معايير الأداء المجتمعية

مؤشر نتيجة
معدل نقل البيانات لكل بطاقة 8 بت في الثانية (بيانات NVIDIA) 4000 قمة
ذاكرة الوصول العشوائي للفيديو لكل بطاقة ذاكرة ECC GDDR96 سعة 7 جيجابايت
عرض النطاق الترددي الذاكرة ~1792 جيجابايت/ثانية
لاما 3.3 70B Q6 أحادي وحدة معالجة الرسومات (مجتمعي) 40-55 توكو/ثانية تيار واحد
لاما 3.3 70B bf16 أحادي وحدة معالجة الرسومات (مجتمعي) 15-25 توكو/ثانية تيار واحد
بلاكويل fp8 الأصلي DeepSeek-V3 fp8 و Hunyuan-A13B fp8 يعملان بدون بث bf16

البيانات منشورة من مصادر خارجية، ولم يتم قياسها على أجهزة كينتينو. ستنشر كينتينو بياناتها الخاصة بعد أول إصدار للعميل.

ليست مثالية لـ

  • تدريب نماذج كبيرة من الصفر (وحدة معالجة رسومية واحدة - بدون توازي الموترات/خطوط الأنابيب)
  • Frontier 200B+ MoE at real quantizations (Qwen3-235B Q4, GLM-4.5/4.6 — use Kentino AI 192 RTXPro6000 or older)
  • الاستدلال متعدد المستأجرين عالي التزامن (الحد الأقصى للإنتاجية الإجمالية لبطاقة واحدة؛ 4x RTX 4090 أو 4x L40 تتوسع بشكل أفضل)

الضمان ومدة التسليم

2 سنة
ضمان قطع الغيار
عام واحد
ضمان العمل
10-28 أيام
المهلة

ضمان NVIDIA الأصلي لمدة 3 سنوات على بطاقة RTX Pro 6000 بالإضافة إلى ضمان تكامل Kentino. تشمل عملية التجميع، وتكوين BIOS، وتثبيت برامج التشغيل، واختبارات التحمل، والتحقق من الأداء. يعتمد وقت التسليم على توفر المكونات، ويتم تأكيده عند الطلب.

الإضافات الموصى بها

  • قم بترقية ذاكرة الوصول العشوائي إلى 512 جيجابايت (أضف 4 × 64 جيجابايت DDR4 - لا تزال هناك أربعة فتحات DIMM متاحة)
  • محرك أقراص ثانوي NVMe بسعة 4 تيرابايت لتخزين مكتبة النماذج / مجموعة البيانات
  • خزانة مفتوحة 24U للتركيب على رفوف الإنتاج
  • للحصول على سرعة ربط من الجيل الخامس x16، يُرجى النظر في إصدار منصة Genoa عند الطلب.

يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.

أليس هذا ما تحتاجه بالضبط؟

أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.