استدلال 35B RTX4090 AI Server
منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.
يتم الاحتفاظ بقائمة المنتجات هذه كمرجع فقط.
تم استبدال هذا الخادم بخط إنتاج Kentino AI الجديد . للاطلاع على النسخة المكافئة الحالية أو نسخة مطورة، يرجى مراجعة مجموعة خوادم الذكاء الاصطناعي لدينا.
البديل الموصى به: Kentino AI 96 Rome 4090 2644TOPS (4x RTX 4090، نفس المنصة، إصدار محدث)
المواصفات
- وحدة معالجة الرسومات: 4x NVIDIA RTX 4090 (إجمالي ذاكرة VRAM 96 جيجابايت)
- اللوحة: رف ASRock ROMED8-2T
- وحدة المعالجة المركزية: AMD EPYC 7542
- الرامات " الذاكرة العشوائية في الهواتف والحواسيب: ذاكرة وصول عشوائي DDR256-4 ECC REG RDIMM سعة 2666 جيجابايت من A-Tech (8 × 32 جيجابايت)
- اتصال وحدة معالجة الرسوميات باللوحة الأم: كابل RYSER PCIe 4.0 x16
- مزود الطاقة: 2x LL2000FC 4 كيلو وات
- الحالة: 24U رف جبل
-
التخزين:
- 2TB NVMe SSD
- محرك أقراص SATA سعة 500 جيجابايت
الميزات الرئيسية
- مُحسَّن لاستدلال الذكاء الاصطناعي: مزود بـ 4 وحدات معالجة رسومية NVIDIA RTX 4090، توفر إجمالي 96 جيجابايت من ذاكرة VRAM، مُهيأة خصيصًا لمهام استدلال الذكاء الاصطناعي عالية الأداء، بما في ذلك نماذج اللغة الكبيرة التي تصل إلى 70B معلمة.
- مكونات من فئة الخادم: تتميز باللوحة الأم الموثوقة ASRock Rack ROMED8-2T ووحدة المعالجة المركزية القوية AMD EPYC 7542 لإمكانات معالجة استثنائية.
- ذاكرة عالية السرعة: تضمن ذاكرة A-Tech DDR256-4 ECC REG RDIMM سعة 2666 جيجابايت معالجة بيانات موثوقة وفعالة لأحمال عمل الذكاء الاصطناعي المعقدة.
- تكامل سريع لوحدة معالجة الرسومات: يستخدم كابل RYSER PCIe 4.0 x16 للحصول على اتصال سريع بنطاق ترددي كامل بين وحدات معالجة الرسومات واللوحة الأم، مما يزيد من أداء الاستدلال.
- مصدر طاقة قوي: توفر وحدة AX1600i بقوة 1500 واط توصيلًا مستقرًا وواسعًا للطاقة لدعم المكونات عالية الأداء تحت أحمال الاستدلال المكثفة.
- تخزين فعال: يأتي مع محرك أقراص SSD NVMe سريع بسعة 2 تيرابايت للوصول السريع إلى البيانات ومحرك أقراص SATA إضافي بسعة 500 جيجابايت لمزيد من السعة.
- تبريد احترافي: يتم وضعه داخل علبة واسعة بحجم 24 وحدة قابلة للتركيب على الرف، مما يضمن إدارة حرارية مثالية للتشغيل المستمر عالي الأداء.
- تصميم يركز على الاستدلال: تم تحسينه لتشغيل نماذج الذكاء الاصطناعي الكبيرة بكفاءة، مما يجعله مثاليًا للمؤسسات التي تنشر خدمات الذكاء الاصطناعي على نطاق واسع.
حالات الاستخدام المثالية
- استدلال نموذج اللغة الكبير (ما يصل إلى 70B من المعلمات)
- تطبيقات الذكاء الاصطناعي في الوقت الفعلي
- خدمات معالجة اللغة الطبيعية
- رؤية الكمبيوتر والتعرف على الصور
- خدمة العملاء و Chatbots المدعومة بالذكاء الاصطناعي
- أنظمة التوصية
- النمذجة المالية والتنبؤات
- تحليل البيانات العلمية
ملاحظات خاصة
- مزايا RTX 4090: من خلال الاستفادة من أحدث وحدات معالجة الرسوميات NVIDIA RTX 4090، يوفر هذا الخادم أداءً استثنائيًا لمهام الاستدلال بالذكاء الاصطناعي، من خلال الجمع بين قوة الحوسبة العالية والميزات المتقدمة مثل Tensor Cores.
- تم تحسينه ليتناسب مع طرازات 70B: مع 96 جيجابايت من إجمالي ذاكرة الوصول العشوائي GPU VRAM، تم تصميم هذا النظام خصيصًا للتعامل مع نماذج اللغة الكبيرة التي تحتوي على ما يصل إلى 70 مليار معلمة، مما يجعله مثاليًا لنشر خدمات الذكاء الاصطناعي المتطورة.
- كفاءة الاستدلال: يتيح الجمع بين وحدات معالجة الرسومات RTX 4090 ووحدة المعالجة المركزية AMD EPYC استدلالًا عالي الكفاءة، مما يتيح إنتاجية عالية وزمن انتقال منخفض لتطبيقات الذكاء الاصطناعي.
- حل قابل للتطوير: على الرغم من تحسينه لنماذج المعلمات 70B، يمكن دمج هذا الخادم بسهولة في مجموعات أكبر لمزيد من أحمال العمل الأكثر تطلبًا أو عمليات النشر متعددة النماذج.
يُعد خادم الذكاء الاصطناعي Inference 70B RTX4090 حلاً متطورًا للمؤسسات التي تتطلع إلى نشر نماذج الذكاء الاصطناعي الكبيرة بكفاءة. فهو يحقق التوازن الأمثل بين الأداء والتكلفة، مما يجعله خيارًا ممتازًا للشركات والمؤسسات البحثية التي تحتاج إلى تشغيل نماذج الذكاء الاصطناعي المعقدة في بيئات الإنتاج. سواء كنت تقوم بنشر نماذج لغوية أو أنظمة رؤية حاسوبية أو تطبيقات ذكاء اصطناعي أخرى، يوفر هذا الخادم الطاقة والموثوقية اللازمتين لاستنتاج الذكاء الاصطناعي بسلاسة على نطاق واسع.
التسليم من 2 إلى 6 أسابيع
الأسئلة التي يطرحها المشترون علينا في أغلب الأحيان قبل طلب خادم.
كم تستغرق عملية الرسم؟
تُشحن الأجهزة المُصنّعة من مكونات متوفرة لدينا بسرعة؛ أما الأجهزة التي تتطلب جيلاً مُحدداً من وحدات معالجة الرسومات (GPU) فيعتمد توفرها على ذلك. نُحدد لك موعداً قبل الدفع، وإذا طرأ أي تغيير، نُبلغك بذلك بدلاً من تركك تكتشف الأمر بنفسك.
هل يمكن تغيير الإعدادات قبل بنائها؟
في أغلب الأحيان. يتم اختيار وحدات معالجة الرسومات والذاكرة والتخزين والتبريد لكل طلب على حدة، والتكوين المذكور هو نقطة انطلاق وليس حزمة ثابتة. إذا كنت بحاجة إلى ذاكرة وصول عشوائي للفيديو أكبر، أو تخزين أسرع، أو نظام تبريد مختلف، فأخبرنا بذلك قبل الطلب وسنقدم لك عرض سعر للتغيير.
هل يمكنني استلام الخادم شخصياً؟
نعم، يمكنك ذلك. يقع مستودعنا في براغ، ونرحب باستلام الطلبات شخصيًا - حيث يستغل معظم الزوار هذه الزيارة لشرح الجهاز لمهندسنا وطرح الأسئلة التي يصعب طرحها عبر البريد الإلكتروني. أما بالنسبة للطلبات داخل جمهورية التشيك، فنحن نسعى جاهدين لتوصيلها شخصيًا وشرح كيفية تركيبها في الموقع.
هل يمكنني التحدث إلى شخص يفهم بالفعل حجم العمل؟
نعم. لدينا مهندس متخصص في أنظمة الذكاء الاصطناعي تحديدًا، وليس موظف مبيعات عام. إذا كان سؤالك يتعلق بأحجام الدُفعات، أو التكميم، أو الربط البيني، أو أين ستكون نقطة الاختناق، فلا تتردد في طرحه - فغالبًا ما تُحسّن هذه المحادثة من إعدادات النظام.
ما هو النموذج الذي يمكنني تشغيله على هذا التكوين؟
نعم. يتم تجميع كل جهاز، واختباره عمليًا، وتقييم أدائه على أحمال عمل حقيقية للذكاء الاصطناعي قبل شحنه، وبذلك نحصل على نظام إدارة التعلم (LLM) مثبت وجاهز للعمل. ما عليك سوى توصيله بالكهرباء، وربطه بشبكتك، والبدء بالعمل - القرار الوحيد المتبقي هو أي مشروع سيتم تشغيله أولًا.
كيف يتم اختبار الخادم قبل شحنه؟
نُجري الاختبارات على أحمال عمل الذكاء الاصطناعي الفعلية بدلاً من النتائج الاصطناعية: معدل نقل البيانات، وسلوك الحمل المستمر، ودرجة الحرارة أثناء التشغيل المتواصل. ستحصل على نتائج الاختبار المعياري مع الجهاز، لذا فإن الأداء الذي وُعدت به هو الأداء الذي يمكنك التحقق منه من اليوم الأول.
هل الخادم جاهز للتشغيل عند وصوله؟
نعم. يتم تجميع كل جهاز، واختباره عمليًا، وتقييم أدائه على أحمال عمل حقيقية للذكاء الاصطناعي قبل شحنه، وبذلك نحصل على نظام إدارة التعلم (LLM) مثبت وجاهز للعمل. ما عليك سوى توصيله بالكهرباء، وربطه بشبكتك، والبدء بالعمل - القرار الوحيد المتبقي هو أي مشروع سيتم تشغيله أولًا.
يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.
أليس هذا ما تحتاجه بالضبط؟
أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.