محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI
كينتينو · خادم الذكاء الاصطناعي المخصص

محطة عمل Kentino AI 32 Rome 5090 1676TOPS — 1x RTX 5090 AI

منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.

€13.000,00السعر لا يشمل ضريبة القيمة المضافة · يتم احتساب تكلفة الشحن عند إتمام عملية الشراء
متوفر في المخزون - يشحن من مستودع الاتحاد الأوروبي
ISO 9001 · أجهزة معتمدةمستودع وضمان الاتحاد الأوروبيأكثر من 7 سنوات في مجال الذكاء الاصطناعي للمؤسساتتم اختبارها قبل الشحن
نظرة عامة
الشحن والضمان

كينتينو AI 32 روما 5090 1676 توبس

محطة عمل بلاكويل أحادية وحدة معالجة الرسومات
بطاقة رسومات واحدة RTX 5090 | معالج EPYC Milan | 1676 TOPS INT8

1 676
أفضل 8
32 جيجا بايت
ذاكرة الفيديو GDDR7
fp8
الموتر الأصلي
رف
استعداد

وحدة معالجة رسومات بلاكويل واحدة، وذاكرة GDDR7 سعة 32 جيجابايت، وذاكرة fp8 أصلية - أفضل محطات عمل الذكاء الاصطناعي أحادية البطاقة التي يبنيها كينتينو.

خادم ذكاء اصطناعي من فئة محطات العمل، مزود بمعالج رسومات واحد، يعمل على منصة ROMED8-2T / EPYC Milan. يوفر معالج RTX 5090 سعة 32 جيجابايت من ذاكرة GDDR7 VRAM مع دعم كامل لعمليات حسابية من نوع fp8 Tensor، مما يجعله الخيار الأمثل لأجهزة المطورين، أو كنقطة نهاية للاستدلال ضمن فريق صغير، أو كمحطة عمل لإنتاج الصور والفيديوهات حيث يتفوق معالج رسومات قوي واحد على معالجين أضعف. يأتي بتصميم 4U مناسب للتركيب في رفوف الخوادم، كما أنه سهل التركيب في المكاتب، مما يجعله مناسبًا للنشر الهادئ أسفل المكاتب.

أجهزة التبخير

مكون التفاصيل
وحدة معالجة الرسوميات‏:‏ 1x NVIDIA GeForce RTX 5090 32 GB GDDR7 (575 واط، PCIe 5.0 x16، Blackwell)
مجموعة ذاكرة الوصول العشوائي للفيديو 32 جيجا بايت
وحدة المعالجة المركزية‏: AMD EPYC 7643 Milan (48 نواة/96 خيط، 225 واط، 128 مسار PCIe 4.0)
اللوحة الأم ASRock Rack ROMED8-2T (SP3, 7x PCIe 4.0 x16, 8x DDR4 ECC, 2x 10 GbE, IPMI)
ذاكرة الوصول العشوائي للنظام 128 جيجابايت DDR4-2666 ECC RDIMM (2 × 64 جيجابايت)
صندوق الأمتعة / التخزين 1 تيرابايت NVMe M.2 (PCIe 4.0 x4)
مزود الطاقة وحدة تزويد طاقة واحدة من نوع ATX بقدرة 2 كيلو واط
الهيكل حامل رف 4U، سلبي من الجيل الرابع x16
تبريد مبرد برج SP3 (فئة Arctic Freezer 4U-M)، 3 فتحات سحب أمامية 120 مم + فتحة عادم خلفية 120 مم
الانرنيت منفذان مدمجان بسرعة 10 جيجابت إيثرنت (إنتل X550) + نظام إدارة الإنترنت الذكي (IPMI)

مغلف الطاقة

  • استهلاك وحدة معالجة الرسومات: 1 × 575 واط = 575 واط
  • إجمالي استهلاك الطاقة للنظام عند الحمل الكامل: ~900 واط
  • إجمالي قدرة وحدة التزويد بالطاقة: 2000 واط (وحدة ATX واحدة بقدرة 2 كيلو واط) - هامش أمان بنسبة 55%
  • هامش انتقالي سخي، تشغيل صامت عند الأحمال الخفيفة

طوبولوجيا المسار

منفذ PCIe Gen4 x16 في وحدة معالجة الرسومات (ROMED8-2T من الجيل الرابع؛ و5090 من الجيل الخامس، ويعمل بتقنية Gen4 دون أي تأثير على عرض النطاق الترددي للاستدلال). 16 مسارًا مباشرًا من وحدة المعالجة المركزية. لا يوجد محول PCIe. لا يوجد NVLink في GeForce 5090.

ما يمكنك تشغيله

بفضل ذاكرة الوصول العشوائي للفيديو GDDR7 بسعة 32 جيجابايت وحسابات الموترات fp8 الأصلية، تتعامل محطة العمل هذه مع نماذج LLM مفتوحة الوزن تصل إلى 32B كثيفة، وتوليد الصور باستخدام FLUX.1، وتوليد الفيديو، والذكاء الاصطناعي الكلامي، ومجموعات النماذج المتعددة لمطور واحد.

ماجستير في القانون - نص / استدلال / برمجة

الحدود الصينية

  • Qwen3-32B Q6_K كثيف - سياق 32 ألف، استدلال عام رائد (~40-55 توكا/ثانية تدفق واحد على Blackwell fp8، مرجع منشور)
  • Qwen3-30B-A3B MoE في Q4_K_M مع هامش KV طويل (Qwen3-Coder-30B-A3B agentic، 256k ctx)
  • كيو دبليو كيو-32 بي السؤال السادس - معاينة الاستدلال
  • ديب سيك-R2 32B sparse MoE at Q4-Q6 — single-GPU reasoning that scores 92.7 % AIME-2025 (~45-60 tok/s single-stream on Blackwell fp8, published reference)
  • Qwen3.5-27B إصدار مكثف Q6 (فبراير 2026)
  • هونيوان-A13B في Q4_K_M (~28-30 جيجابايت) — 80 بايت/13 بايت MoE، 256 ألف سياق، استدلال ثنائي الوضع
  • Seed-OSS-36B Q4_K_M — سياق أصلي بحجم 512 كيلوبايت لتحليل المستندات الطويلة

الحدود الغربية

  • اللاما 3.3 70 ب في الربع الثاني من عام 2 (حوالي 27 جيجابايت مضغوطة) أو الربع الثالث من عام 3 (حوالي 34 جيجابايت مع فائض ذاكرة الوصول العشوائي) - قابلة للاستخدام للمحادثات العامة
  • ميسترال صغير 3 / ماجيسترال صغير / ديفسترال صغير 2 (24B كثيف) في Q6-Q8 أو bf16
  • جيما 3 27 ب متعدد الوسائط في الربع السادس مع سياق 128 ألف
  • فاي-4 14ب / الاستدلال فاي-4 bf16
  • ريكا فلاش 3 (21 بايت أباتشي 2.0) في bf16
  • gpt-oss-20b ذاكرة MXFP4 أصلية (~16 جيجابايت - تتناسب مع KV كبير)

الرؤية واللغة

Qwen3-VL-8B / -32B في Q4-Q6؛ Qwen3-VL-30B-A3B MoE؛ InternVL3.5-8B / -38B Q4؛ MiniCPM-V 2.6 / MiniCPM-o 2.6 (8B)؛ Llama 3.2 11B Vision bf16؛ Pixtral 12B bf16 (24 جيجابايت - ضيق، استخدم Q8)؛ Gemma 3 12B / 27B متعدد الأنماط؛ PaliGemma 2 (3/10B)؛ Phi-4-متعدد الأنماط 5.6B؛ Aya Vision 8B.

توليد الصور

FLUX.1 [dev] / [schnell] fp8 (~12 جيجابايت) تسريع أصلي لـ Blackwell (~8-12 ثانية لكل صورة 1024x1024 عند 20 خطوة على Blackwell، مرجع منشور)؛ FLUX.1 Kontext [dev] — تحرير في السياق، اتساق الأحرف؛ SD 3.5 Large (18 جيجابايت fp16 / 11 جيجابايت fp8)؛ SDXL 1.0 10-12 جيجابايت fp16؛ HunyuanImage-2.1 NF4 (~14 جيجابايت)؛ Kolors 2.0 fp8؛ AuraFlow v0.3 / OmniGen v1 / PixArt-Sigma.

توليد الفيديو

Wan 2.2 TI2V-5B بسعة 16 جيجابايت تقريبًا — 720p@24fps على بطاقة 5090 واحدة؛ Wan 2.1 T2V/I2V 14B في الربع الرابع إلى الربع السادس (16 جيجابايت تقريبًا)؛ HunyuanVideo 1.5 (8.3B) — 14 جيجابايت كحد أدنى؛ CogVideoX-5B / 5B-I2V int8 (12 جيجابايت تقريبًا)؛ LTX-Video 2B فئة الوقت الحقيقي 30 إطارًا في الثانية؛ Mochi-1 الربع الرابع (17-18 جيجابايت تقريبًا).

الصوت / الكلام / تحويل النص إلى كلام

  • ASR: Whisper v3 كبير / توربو (~50 ضعف الوقت الحقيقي على وحدة معالجة رسومات واحدة، مرجع منشور)؛ NVIDIA Parakeet-TDT 1.1B؛ Canary 1B
  • تحويل النص إلى كلام: CosyVoice 2.0 / Fun-CosyVoice 3.0؛ Kokoro 82M؛ Stable Audio Open
  • في الوقت الحقيقي / من جهاز لآخر: كيوتاي موشي (7ب) — صوت ثنائي الاتجاه كامل في الوقت الحقيقي فقط؛ ستيب-أوديو 2 ميني / R1

متعدد النماذج / متعدد المستأجرين

  • مجموعة البرامج المقيمة لمطور واحد: Qwen3-32B Q6 (~20 جيجابايت) + FLUX.1 fp8 (~12 جيجابايت تناسب بشكل ضيق) على التبديل، أو Qwen3-14B Q6 (~9 جيجابايت) + FLUX.1 + Whisper-turbo + Kokoro في وقت واحد (~20-24 جيجابايت مثبتة)
  • 2-4 مستخدمين متزامنين على وحدات إدارة التعلم من الفئة 14-32B عبر vLLM / SGLang
  • ضبط دقيق لنماذج LoRA / QLoRA الكثيفة من 7 إلى 14 مليار

أحمال العمل المستهدفة

  • محطة عمل للمطورين لمهندس ذكاء اصطناعي واحد، تعمل على الاستدلال المختلط وتوليد الصور.
  • نقطة نهاية وكيل الترميز لفريق صغير (Qwen3-Coder-30B-A3B) مع 1-4 مستخدمين متزامنين
  • مسار معالجة المحتوى: FLUX.1 أو SD 3.5، توليد صور بكميات كبيرة + فيديو قصير عبر WAN 2.2
  • نظام صوتي داخلي بتقنية التعرف التلقائي على الكلام وتحويل النص إلى كلام (Whisper + Kokoro + Moshi) لفرع مكتب
  • صندوق أبحاث Prosumer LLM + VLM — اختبار Qwen3 و Llama 3.3 و Gemma 3 و Phi-4 على أجهزة حقيقية

المراجع المنشورة للأداء

مرجع منشور | جهاز مماثل لبطاقة RTX 5090 واحدة

مؤشر نتيجة
Llama 3.3 70B Q4_K_M فك تشفير llama.cpp حوالي 18-22 توكا/ثانية مع تفريغ وحدة المعالجة المركزية KV
Qwen3-32B Q6 vLLM أحادي التدفق فك تشفير بسرعة 45-55 توك/ثانية تقريبًا باستخدام FP8
FLUX.1 [dev] fp8 على Blackwell حوالي 1.7-2.0 ثانية لكل صورة بحجم 1024×1024 بكسل عند 20 خطوة
مقطع فيديو بدقة 720 بكسل من نوع Wan 2.2 TI2V-5B حوالي 3-4 دقائق عند fp16

تم نشر نقاط مرجعية من أجهزة 5090 أحادية مماثلة. سيتم نشر الأرقام التي قاسها كينتينو بمجرد أن توسع شركة gf-logic نطاق الاختبار ليشمل أجهزة 5090 أحادية.

ليست مثالية لـ

  • نماذج 70B كثيفة في Q6+ (32 جيجابايت غير كافية - استخدم 2x 5090 للحصول على مساحة تخزين مناسبة تبلغ 64 جيجابايت)
  • خدمة متزامنة متعددة المستخدمين على نطاق واسع (تقسيم متوازي أحادي الموتر)
  • Frontier 100B+ MoE (GLM-4.5، Kimi K2، Mistral Large 3 — خارج متناول بطاقة المستهلك الفردية)

الضمان ومدة التسليم

2 سنة
ضمان قطع الغيار
عام واحد
ضمان العمل
10-28 أيام
المهلة

تشمل عملية التجميع، وتكوين نظام الإدخال والإخراج الأساسي (BIOS)، وتثبيت برامج التشغيل، واختبار التشغيل الأولي، والتحقق من الوظائف. يعتمد وقت التسليم على توافر المكونات، ويتم تأكيده عند الطلب.

الإضافات الموصى بها

  • نفيديا كونيكت اكس-5 100 جيجا بايت MCX555A-ECAT
  • قم بترقية محرك الأقراص الرئيسي إلى محرك أقراص NVMe بسعة 2 تيرابايت أو 4 تيرابايت
  • قم بترقية ذاكرة الوصول العشوائي (RAM) إلى 256 جيجابايت (4 × 64 جيجابايت DDR4) للحصول على ذاكرة تخزين مؤقتة أكبر لـ KV / مجموعات متزامنة متعددة النماذج
  • وحدة توزيع الطاقة المثبتة على الرف (مزودة بعداد C13/C19) ووحدة تزويد الطاقة غير المنقطعة المتصلة بالشبكة بقدرة 2 كيلو فولت أمبير

يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.

أليس هذا ما تحتاجه بالضبط؟

أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.