كينتينو · خادم الذكاء الاصطناعي المخصص

NVIDIA L4 24 GB GDDR6 — منخفض الارتفاع سلبي

منصة على مستوى المؤسسات، تم تجميعها واختبارها في الاتحاد الأوروبي.

€2.657,42 السعر لا يشمل ضريبة القيمة المضافة · يتم احتساب تكلفة الشحن عند إتمام عملية الشراء
متوفر في المخزون - يشحن من مستودع الاتحاد الأوروبي
ISO 9001 · أجهزة معتمدةمستودع وضمان الاتحاد الأوروبيأكثر من 7 سنوات في مجال الذكاء الاصطناعي للمؤسساتتم اختبارها قبل الشحن
نظرة عامة
الأسئلة الشائعة
الشحن والضمان
آدا لوفليس · 24 جيجابايت · 72 واط · تصميم منخفض الارتفاع

بطاقة NVIDIA L4 بسعة 24 جيجابايت - بطاقة استدلال بقدرة 72 واط

وحدة معالجة رسومات (GPU) أحادية الفتحة، منخفضة الارتفاع، ومبردة تبريدًا سلبيًا، مصممة لمراكز البيانات، تستهلك 72 واط فقط مباشرةً من فتحة PCIe - بدون كابل طاقة، وبدون تصميم إضافي لتدفق الهواء. إنها الطريقة الأمثل لإضافة 24 جيجابايت من سعة الاستدلال إلى الخادم.

24 GB
ذاكرة GDDR6 ECC للفيديو
7,680
النوى CUDA
72 W
يعمل بالفتحة
1 فتحة
تصميم منخفض الارتفاع، سلبي
نظرة عامة

الكثافة والكفاءة، وليس ذروة الإنتاجية

تُبنى بطاقة L4 على مبدأ مختلف عن بطاقات التسريع الكبيرة: الأداء لكل واط ولكل فتحة. فهي لا تحتاج إلى موصل طاقة إضافي، وبفضل تصميمها المنخفض الارتفاع وفتحتها الواحدة، تتناسب مع الهياكل التي لا تستوعب بطاقات كاملة الارتفاع. هذا المزيج هو ما يجعلها الخيار الأمثل لتجميع العديد من أحمال عمل الاستدلال المستقلة في خادم واحد، أو لإضافة تسريع ذكاء اصطناعي فعال إلى الأنظمة الصغيرة والطرفية حيث تُمثل الطاقة والمساحة القيود الأساسية. كما أنها بطاقة فيديو قوية - تدعم التشفير وفك التشفير المادي، بما في ذلك AV1 - مما يجعلها خيارًا شائعًا للتحويل البرمجي جنبًا إلى جنب مع الاستدلال.

المواصفات

معلومات تقنية

وحدة معالجة الرسوميات‏:‏ NVIDIA AD104 — آدا لوفليس
رقم القطعة TCSL4PCIE-PB
ذاكرة 24 جيجا بايت GDDR6 مع ECC
عرض النطاق الترددي الذاكرة ~300 جيجابايت/ثانية
النوى CUDA 7,680
النوى الموتر 240 (الجيل الخامس) · ~242 TOPS INT8
RT النوى 60 (الجيل الثالث)
السطح البيني PCIe 4.0 ×16
طاقة اللوحة 72 واط - يتم سحبها من الفتحة، بدون موصل طاقة
شكل عامل فتحة واحدة، تصميم منخفض، طول كامل
تبريد سلبي - يتطلب تدفق هواء الهيكل
مخرجات العرض لا شيء - الحساب فقط
محركات الفيديو التشفير/فك التشفير باستخدام الأجهزة، بما في ذلك AV1
الضمان لمدة 36 أشهر
أفضل ل

أين يناسب

  • خدمة النماذج الصغيرة والمتوسطة الحجم - سعة 24 جيجابايت تستوعب بشكل مريح نموذجًا بحجم 7B-13B.
  • خوادم الاستدلال متعددة وحدات معالجة الرسومات: عند استهلاك 72 واط لكل بطاقة، يمكنك تركيب عدة بطاقات دون إعادة تصميم الطاقة أو التبريد.
  • هيكل صغير الحجم ومنخفض الارتفاع لا يمكنه استيعاب بطاقة ذات فتحتين كاملة الارتفاع.
  • خطوط نقل ترميز الفيديو، بما في ذلك AV1، جنبًا إلى جنب مع الاستدلال على نفس البطاقة.
  • عمليات النشر على الحافة وفي المواقع المحلية حيث يتم تحديد الحد الأقصى لاستهلاك الطاقة الإجمالي.
بطاقة L4 مصممة للسعة والكفاءة، وليست الأفضل من حيث الإنتاجية. للمهام التي تتطلب ضبطًا دقيقًا، أو معالجة نماذج كبيرة، أو الحصول على أقصى عدد من الرموز في الثانية، يُنصح باستخدام بطاقة RTX PRO 6000 أو نظام متعدد وحدات معالجة الرسومات - أخبرنا بمتطلبات العمل وسنساعدك في اختيار الأنسب.
الأسئلة المتكررة

الأسئلة الشائعة

هل يحتاج إلى كابل طاقة؟

لا. تعمل البطاقة بالكامل ضمن حدود استهلاك الطاقة المسموح بها في منفذ PCIe (75 واط)، لذا لا حاجة لتوصيل أي موصلات ذات 8 أو 12 سنًا. وهذا جزء كبير من جاذبيتها في التجميعات ذات الكثافة العالية، إذ يُلغي تمامًا قيود كابلات وحدة التزويد بالطاقة.

هل سيبرد من تلقاء نفسه؟

لا. مثل بطاقات مراكز البيانات الأخرى، تعتمد هذه البطاقة على تدفق الهواء داخل الهيكل. وهذا مثالي في الخوادم ذات مسار تهوية مناسب من الأمام إلى الخلف؛ أما في أجهزة الكمبيوتر المكتبية الهادئة، فسترتفع درجة حرارتها. تواصل معنا إذا كنت غير متأكد من مواصفات هيكل جهازك.

ما هي أحجام الطرازات التي تتناسب مع سعة 24 جيجابايت؟

يتناسب نموذج 7B–13B الكمي مع مراعاة السياق. أما نموذج 70B فلا يتناسب، إذ يحتاج إلى حوالي 40 جيجابايت بدقة 4 بت، لذا يُنصح بالبحث عن بطاقة ذاكرة بسعة 96 جيجابايت أو تكوين متعدد وحدات معالجة الرسومات.

كيف تتم مقارنته مع L40؟

يتميز محرك الأقراص L40 بسعة 48 جيجابايت وقدرة معالجة أعلى بكثير، حيث يستهلك حوالي 300 واط ويأتي بتصميم ثنائي الفتحات كامل الارتفاع. أما محرك الأقراص L4، فيستهلك 72 واط فقط، ويأتي بفتحة واحدة، ويتميز بتصميم منخفض الارتفاع، مما يقلل من سرعة نقل البيانات. اختر L4 عندما يكون الأداء والكثافة هما العاملان الحاسمين في تصميم الجهاز، واختر L40 عندما تحتاج إلى الأداء العالي.

هل يمكنني وضع عدة خوادم في خادم واحد؟

نعم، وهنا تبرز مزايا الطبقة الرابعة (L4) بشكلٍ لافت؛ حيث تتيح عدة بطاقات بقدرة 72 واط لكل منها إمكانية تحقيق ميزانيات يصعب تحقيقها مع وحدات معالجة الرسومات عالية الطاقة. كما توفر شركة كينتينو خوادم استدلال متعددة الطبقات من الطبقة الرابعة (L4) لمن يفضل شراء الجهاز الجاهز.

ما هي المهلة الزمنية؟

يتم توفيرها حسب الطلب، وعادةً ما يستغرق ذلك من 10 إلى 21 يومًا. يُرجى التواصل معنا للتأكد من التوفر الحالي قبل تحديد موعد الشراء.

هل تريدها في جهاز جاهز؟ تقوم شركة كينتينو ببناء واختبار وتشغيل خوادم الاستدلال متعددة الطبقات من المستوى الرابع - اطلب منا تصميمًا مُهيأً.

الأسئلة التي يطرحها المشترون علينا في أغلب الأحيان قبل طلب خادم.

كم تستغرق عملية الرسم؟

تُشحن الأجهزة المُصنّعة من مكونات متوفرة لدينا بسرعة؛ أما الأجهزة التي تتطلب جيلاً مُحدداً من وحدات معالجة الرسومات (GPU) فيعتمد توفرها على ذلك. نُحدد لك موعداً قبل الدفع، وإذا طرأ أي تغيير، نُبلغك بذلك بدلاً من تركك تكتشف الأمر بنفسك.

هل يمكن تغيير الإعدادات قبل بنائها؟

في أغلب الأحيان. يتم اختيار وحدات معالجة الرسومات والذاكرة والتخزين والتبريد لكل طلب على حدة، والتكوين المذكور هو نقطة انطلاق وليس حزمة ثابتة. إذا كنت بحاجة إلى ذاكرة وصول عشوائي للفيديو أكبر، أو تخزين أسرع، أو نظام تبريد مختلف، فأخبرنا بذلك قبل الطلب وسنقدم لك عرض سعر للتغيير.

هل يمكنني استلام الخادم شخصياً؟

نعم، يمكنك ذلك. يقع مستودعنا في براغ، ونرحب باستلام الطلبات شخصيًا - حيث يستغل معظم الزوار هذه الزيارة لشرح الجهاز لمهندسنا وطرح الأسئلة التي يصعب طرحها عبر البريد الإلكتروني. أما بالنسبة للطلبات داخل جمهورية التشيك، فنحن نسعى جاهدين لتوصيلها شخصيًا وشرح كيفية تركيبها في الموقع.

هل يمكنني التحدث إلى شخص يفهم بالفعل حجم العمل؟

نعم. لدينا مهندس متخصص في أنظمة الذكاء الاصطناعي تحديدًا، وليس موظف مبيعات عام. إذا كان سؤالك يتعلق بأحجام الدُفعات، أو التكميم، أو الربط البيني، أو أين ستكون نقطة الاختناق، فلا تتردد في طرحه - فغالبًا ما تُحسّن هذه المحادثة من إعدادات النظام.

ما هو النموذج الذي يمكنني تشغيله على هذا التكوين؟

نعم. يتم تجميع كل جهاز، واختباره عمليًا، وتقييم أدائه على أحمال عمل حقيقية للذكاء الاصطناعي قبل شحنه، وبذلك نحصل على نظام إدارة التعلم (LLM) مثبت وجاهز للعمل. ما عليك سوى توصيله بالكهرباء، وربطه بشبكتك، والبدء بالعمل - القرار الوحيد المتبقي هو أي مشروع سيتم تشغيله أولًا.

كيف يتم اختبار الخادم قبل شحنه؟

نُجري الاختبارات على أحمال عمل الذكاء الاصطناعي الفعلية بدلاً من النتائج الاصطناعية: معدل نقل البيانات، وسلوك الحمل المستمر، ودرجة الحرارة أثناء التشغيل المتواصل. ستحصل على نتائج الاختبار المعياري مع الجهاز، لذا فإن الأداء الذي وُعدت به هو الأداء الذي يمكنك التحقق منه من اليوم الأول.

هل الخادم جاهز للتشغيل عند وصوله؟

نعم. يتم تجميع كل جهاز، واختباره عمليًا، وتقييم أدائه على أحمال عمل حقيقية للذكاء الاصطناعي قبل شحنه، وبذلك نحصل على نظام إدارة التعلم (LLM) مثبت وجاهز للعمل. ما عليك سوى توصيله بالكهرباء، وربطه بشبكتك، والبدء بالعمل - القرار الوحيد المتبقي هو أي مشروع سيتم تشغيله أولًا.

يتم الشحن من مستودعنا في الاتحاد الأوروبي. قد تتطلب المنتجات الثقيلة ترتيبات شحن خاصة - تواصلوا معنا للحصول على عرض سعر للشحن ومدة التوصيل. ضمان محدود لمدة عامين مع دعم متقدم لخدمة ما بعد الإرجاع؛ يتوفر ضمان ممتد.

أليس هذا ما تحتاجه بالضبط؟

أخبرنا عن حجم العمل الذي تقوم به وسنقوم بتحديد مواصفات هذه المنصة بناءً عليه - وحدات معالجة الرسومات والذاكرة والتخزين والتبريد التي تتناسب مع ما تقوم بتشغيله فعليًا.