التكلفة لكل مليون رمز: محليًا مقابل سحابيًا

توجد ثلاث طرق موثوقة لشراء بيانات استدلال LLM في عام 2026: الاتصال بنقطة نهاية مستضافة لدى جهة أخرى والدفع مقابل كل رمز مميز (واجهة برمجة تطبيقات LLM السحابية)، أو استئجار وحدة معالجة رسومية (GPU) بالساعة وتشغيل النموذج الخاص بك (استئجار وحدة معالجة رسومية سحابية)، أو شراء خادم وتشغيله في بيئة محلية (محلي). يختلف سعر مليون رمز مميز اختلافًا كبيرًا بين هذه الطرق الثلاث، وليس بالترتيب الذي يتوقعه معظم المشترين.

تُجري هذه المقالة حساباتها باليورو (باستثناء ضريبة القيمة المضافة). الجمهور المستهدف: شخص يُقرر ما إذا كان سيستمر في دفع اشتراكه الشهري لشركة OpenAI، أو ينتقل إلى مزود خدمة استضافة مفتوحة النموذج، أو يستأجر جهاز H100، أو يشتري جهازًا مزودًا بـ 4 أو 8 وحدات معالجة رسومية. نعرض أسعار مايو 2026 ونختتم بمخطط انسيابي لاتخاذ القرار في خمس دقائق. مراجع ذات صلة: T01 التكلفة الإجمالية للملكية لكل وحدة معالجة رسومية، W07 اختيار البطاقة، I04 أرقام على جانب الجدار.

المنصات الثلاث

واجهة برمجة تطبيقات إدارة التعلم السحابية. OpenAI، وAnthropic، وGoogle، وTogether، وFireworks. الدفع مقابل كل رمز مُدخل ومُخرج. لا توجد تكلفة للتشغيل الخامل، ولا نفقات رأسمالية، ولا عمليات تشغيل. كما لا يوجد خيار لنموذج يتجاوز كتالوجهم، ولا LoRa، ولا تحكم كمي.

تأجير وحدات معالجة الرسومات السحابية. خدمات AWS p5/p5e/p6، وAzure ND H200/B200، وGCP A3 Ultra، بالإضافة إلى خدمات سحابية متخصصة (Lambda، وCoreWeave، وNebius، وRunPod). استأجر وحدة معالجة رسومية (GPU) بالساعة وشغّل أي شيء تريده. أنت توفر النموذج، وبنية الخدمة، والعمليات. تدفع سواءً خدمت رمزًا واحدًا أو مليار رمز في تلك الساعة.

في الموقع. اشترِ جهازًا بأربعة أو ثمانية وحدات معالجة رسومية. ثبّته في مبنى أو مركز بيانات. أنت مسؤول عن توفير الطاقة والتبريد والشبكات والعمليات. استهلك التكلفة على مدى ثلاث سنوات. التكلفة الحدية للجهاز هي الكهرباء. أما التكلفة الثابتة فهي كل ما دفعته سابقًا.

ثلاثة أشكال مختلفة للتكلفة - متغيرة بحتة، ثابتة بحتة مع انحدار حاد، رأس مال زائد هامشي - والتي تتعادل مع بعضها البعض عند نقاط مختلفة على طول محور الإنتاجية.

أسعار واجهة برمجة تطبيقات إدارة الأصول القانونية السحابية

الدولار الأمريكي لكل مليون رمز، صفحات التسعير العامة، مايو 2026. اليورو بسعر EUR/USD ≈ 1.08.

مزود الموديل أدخل $/Mtok الناتج $/Mtok المدخلات €/Mtok الناتج €/مليون توكا
OpenAI GPT-5 1.25 10.00 1.16 9.26
OpenAI GPT-5 ميني 0.25 2.00 0.23 1.85
OpenAI GPT-5 نانو 0.05 0.40 0.05 0.37
OpenAI GPT-4.1 / o3 2.00 8.00 1.85 7.41
أنثروبي كلود أوبس 4.7 15.00 75.00 13.89 69.44
أنثروبي كلود سونيت 4.6 3.00 15.00 2.78 13.89
أنثروبي كلود هايكو 4.5 1.00 5.00 0.93 4.63
جوجل الجوزاء 2.5 برو 1.25 10.00 1.16 9.26
جوجل الجوزاء 2.5 فلاش 0.30 2.50 0.28 2.31
جوجل جيميني 2.5 فلاش لايت 0.10 0.40 0.09 0.37
معا اللاما 3.3 70 ب 0.88 0.88 0.81 0.81
معا كوين 2.5 72 ب 1.20 1.20 1.11 1.11
معا برنامج DeepSeek-V3 1.25 1.25 1.16 1.16
معا اللاما 3.1 405 ب 3.50 3.50 3.24 3.24
AWS الأساس اللاما 3.3 70 ب 0.72 0.72 0.67 0.67
Azure اللاما 3.3 70 ب 0.59 0.79 0.55 0.73

قراءتان صادقتان. نماذج Frontier المغلقة (Claude Opus 4.7، GPT-5، Gemini 2.5 Pro) أغلى بعشرة أضعاف من واجهات برمجة التطبيقات المفتوحة المستضافة التي تخدم Llama 70B أو DeepSeek-V3 - وهذا هو ثمن "الأذكى حاليًا" مقابل "أفضل الأوزان المفتوحة حاليًا". بالنسبة لمعظم أحمال العمل الإنتاجية (RAG، خطوات الوكيل، التعليمات البرمجية، التصنيف)، يُعد Sonnet 4.6 أو GPT-5 mini نقطة التشغيل، وليس النموذج الرائد. تكلف رموز الإخراج من ثلاثة إلى سبعة أضعاف تكلفة المدخلات على الموفرين المغلقين، وتكون مساوية تقريبًا على مضيفي النماذج المفتوحة. تفرض وحدات SKU للنماذج المفتوحة من Hyperscaler (Bedrock، Azure) علاوة تتراوح بين 30% و80% مقارنةً بـ Together أو Fireworks لنفس النموذج - أنت تدفع مقابل تكامل IAM وفاتورة واحدة، وليس رموزًا أرخص.

تكلفة MTok في الموقع

تكلفة وحدة Mtok هي التكلفة الإجمالية على مدى ثلاث سنوات مقسومة على عدد الرموز المستخدمة خلال ثلاث سنوات. يعتمد المقام على الاستخدام، بينما يكون البسط ثابتًا تقريبًا.

On-prem €/Mtok =
    (capex + 3y electricity + 3y maintenance + 3y ops) /
    (sustained tok/s × utilization × 3 × 8,760 × 3,600 / 1e6)

إدخال التكلفة الإجمالية للملكية لكل وحدة معالجة رسومية من T01 عند استخدام 60%، 0.20 يورو/كيلوواط ساعة، PUE 1.4:

نبنيها إجمالي تكلفة الملكية خلال 3 سنوات € توك/ث مستدام الرموز/3 سنوات (Mtok) € / Mtok
4× RTX 5090 (Llama 70B INT4 TP=4) 27,000 1,800 102,000 0.26
4 × Pro 6000 BW SE (Llama 70B FP8 DP) 58,000 1,920 109,000 0.53
4 × Pro 6000 BW SE (Qwen 32B INT4) 58,000 2,400 136,000 0.43
8 × Pro 6000 BW SE (Llama 70B FP8 DP) 115,000 3,800 215,000 0.53
8× L4 (Llama 8B FP8) 36,000 5,200 295,000 0.12

إذا انخفض معدل الاستخدام إلى 30%، يتضاعف كل رقم. وإذا ارتفع إلى 80%، يصل سعر 8 مليارات وحدة مُخدّمة بواسطة الطبقة الرابعة إلى 0.09 يورو/مليون توكو، وهو أرخص من أي واجهة برمجة تطبيقات سحابية أخرى من نفس الفئة. ينهار الحساب عند استخدام أقل من 25% لأن التكلفة الإجمالية للملكية تهيمن عليها النفقات الرأسمالية التي دفعتها سواءً استخدمت الخدمة أم لا.

التعادل

قم بتراكب خط السحاب. لاما 70B في 100 مليون رمز مميز شهريًاتوزيع متوازن بنسبة 50/50 على منصة Together: 100 × 0.81 يورو = 81 يورو شهريًا ← 2,916 يورو على مدى ثلاث سنوات. بالمقارنة مع 4 × 5090 على منصة محلية بتكلفة 27,000 يورو، تتفوق Together بفارق 24,000 يورو. عند 100 مليون رمز مميز شهريًا، تُعتبر المنصة المحلية خيارًا غير مُجدٍ على الإطلاق.

يدفع الى 1 مليار رمز مميز شهريًا1,000 × 0.81 يورو = 810 يورو شهريًا ← 29,160 يورو على مدى ثلاث سنوات. يبلغ الفرق بين تكلفة النظامين معًا وتكلفة 4 × 5090 أقل من 2,000 يورو. وبتكلفة 1.5 مليار يورو شهريًا، يحقق النظام المحلي ربحًا كبيرًا.

نقطة التعادل لـ الاستدلال من الفئة 70B مقابل أرخص واجهة برمجة تطبيقات مفتوحة النموذج الأراضي حول 1.0–1.5 مليار رمز مميز شهريًا مستدام على 4× 5090. بالنسبة للمواد الصيدلانية الفعالة ذات الحدود المغلقة (Claude Sonnet 4.6 بسعر 8.34 يورو/مليون توكا مُدمج، وGPT-5 بسعر 5.21 يورو/مليون توكا مُدمج)، تنتقل نقطة التعادل إلى 80-150 مليون رمز مميز شهريًا — خط السحابة أكثر انحداراً بعشرة أضعاف.

هذا هو الرقم الأهم في هذه المقالة: نقطة التعادل ليست "100 مليون رمز مميز شهريًا لكل شيء". إنها خاصة بعبء العمل، وتعتمد كليًا على خط السحابة الذي تتنافس معه. عادةً ما يقارن المشترون الذين يقولون "لقد وصلنا إلى 50 مليون، يجب أن ننتقل إلى النظام المحلي" مع Claude Opus، حيث يكونون على حق - متجاهلين أن نقل عبء العمل من Opus إلى Sonnet 4.6 يوفر لهم خمسة أضعاف ما يوفره الانتقال من Sonnet إلى النظام المحلي عند هذا الحجم.

استئجار وحدة معالجة الرسومات السحابية - الخيار المتوسط

أسعار الساعة لكل وحدة معالجة رسومية، مايو 2026 عند الطلب:

مزود حتة وحدات معالجة الرسومات مثيل $/ساعة $/GPU-hr
AWS تكبير 8× H100 SXM 55.18 6.90
AWS ص5هـ.48xكبير 8× H200 SXM 30.00 3.75
AWS ص6-ب200 8× B200 74.88 9.36
Azure ND H200 v5 8× H200 31.00 3.88
GCP a3-ultragpu-8g 8× H200 28.00 3.50
لامدا 8× H100 8× H100 16.00 2.00
كور نسج 8× H100 8× H100 19.20 2.40

تُقدم الالتزامات المحجوزة لمدة عام واحد خصمًا يتراوح بين 25% و35%. يُعادل استخدام AWS p5 عند الطلب ما يُقارب ثلاثة أضعاف Lambda لنفس شريحة H100. وبحساب التكلفة لكل رمز مميز: ثمانية أضعاف شريحة H100 على Lambda تُشغل Llama 3.3 70B FP8 بمعدل 3,500 رمز مميز/ثانية بشكل مستدام ← 16 دولارًا/ساعة × 8,760 × 3 = 389,000 يورو على مدى 3 سنوات ← 1.96 يورو/مليون رمز مميز عند استخدام 60%. 4× و8× Pro 6000 SE في بيئة محلية (0.53 يورو/متك) و 2.5 ضعف مجرد الاتصال معًا (0.81 يورو/متك).

يُعدّ استئجار جهاز H100 لخدمة استدلال النماذج المفتوحة أسوأ الخيارات المتاحة: تكاليف استئجار الجهاز وتكاليف تشغيله. ولا يُجدي هذا الخيار نفعًا إلا عند الحاجة إلى نموذج مُحدد لا يستضيفه أحد، مع عدم توفر حجم كافٍ لتشغيله محليًا. أما استئجار وحدة معالجة الرسومات السحابية، فله استخدام واحد مُبرر: التدريب المكثفتُكلّف عملية ضبط دقيق لشبكة LoRa على 8 وحدات H100 لمدة 8 ساعات حوالي 130 دولارًا أمريكيًا في Lambda. لا يوجد حلٌّ محليٌّ يُضاهي هذا السعر لمرة واحدة. لا تنتقل المنطق إلى الاستدلال، الذي يستمرّ ويعمل على مدار الساعة. فخّ "التشغيل الفوري": توفّر مستويات التشغيل الفوري/القابل للمقاطعة/المجتمعية خصمًا يتراوح بين 50% و80%، لكنّها قابلة للمقاطعة. هذا مناسبٌ لنسخ الاستدلال عديمة الحالة. بالنسبة لمهمة تدريب مدتها 18 ساعة مع نقاط تفتيش في كل خطوة، فإنّ مقاطعتين تُضاعفان تكلفة كل خطوة مكتملة، ولن تكون أرخص من التشغيل عند الطلب.

تكاليف خفية لا يذكرها أحد

سحابة: تُفرض رسوم على نقل البيانات الصادرة تتراوح بين 0.05 و0.09 دولار أمريكي لكل جيجابايت عند إرسال الصور أو الملفات الصوتية أو مقاطع الفيديو. وتزيد عمليات تسجيل البيانات من هذه الرسوم بنسبة 5 إلى 10% عند زيادة حجم البيانات. سياق إعادة الفوترة الأسوأ هو أن كل واجهة برمجة تطبيقات تفرض رسومًا كاملة على كل استدعاء، لذا فإن سياق الوكيل الذي يتطلب 50 ألف رمز يكلف 50 ألف رمز إدخال. خطوة في حلقة مكونة من 20 خطوة. يقلل التخزين المؤقت الفوري (الذي تدعمه كل من أنثروبيك، وأوبن إيه آي، وجوجل) من هذا الاستهلاك بنسبة 50-90% على البادئات المخزنة مؤقتًا، ولكن فقط إذا تم تصميم النظام وفقًا لذلك. تبدأ حدود معدل الإنتاج من 30 ألف إلى 500 ألف عملية في الدقيقة، وتتطلب سجل استخدام؛ ولا يمكن للعملاء الجدد التشغيل على نطاق واسع في اليوم الأول. وحدات SKU في منطقة الاتحاد الأوروبي أغلى بنسبة 10-20% من منطقة شرق الولايات المتحدة، مع توفر أقل.

في الموقع: تبلغ تكلفة وقت التشغيل، بمعدل 0.1-0.3 موظف بدوام كامل لكل خادم، ما بين 8 و24 يورو سنويًا، وهي غير محسوبة ضمن تكلفة مليون توك. يتطلب وقت التوقف وجود خادم احتياطي أو حل سحابي سلس. لا تصل تكلفة الكهرباء إلى 0.20 يورو/كيلوواط ساعة في كل مكان — تتراوح أسعار الكهرباء الصناعية في الاتحاد الأوروبي لعام 2026 بين 0.09 يورو/كيلوواط ساعة (السويد، النرويج، الطاقة الكهرومائية) و0.35 يورو/كيلوواط ساعة (إيطاليا، أيرلندا)، بينما تتراوح في ألمانيا بين 0.18 و0.22 يورو/كيلوواط ساعة في القطاع الصناعي المدعوم، وفي جمهورية التشيك بين 0.18 و0.25 يورو/كيلوواط ساعة في القطاع التجاري المفتوح. أما بالنسبة لإيطاليا أو أيرلندا، فإن كل صف من صفوف الكهرباء في T01 يرتفع السعر بنسبة 50%. يبلغ سعر خزانة الخوادم من 100 إلى 300 يورو شهريًا لخزانة 4U، أي ما يعادل 3,600 إلى 10,800 يورو على مدى ثلاث سنوات بالإضافة إلى تكلفة الأجهزة.

يُقدّر سعر الحوسبة السحابية المعلن بنحو 1.2 إلى 1.5 ضعف الفاتورة الفعلية؛ بينما يُقدّر إجمالي تكلفة الملكية المعلنة للأنظمة المحلية بنحو 1.2 إلى 1.5 ضعف السعر المعلن. وتُلغى معاملات الضرب عند المقارنة.

العوامل غير المتعلقة بالتكلفة

ثلاثة أمور تتجاوز تكلفة Mtok بالنسبة للمشترين الحقيقيين.

سيادة البيانات. السبب الرئيسي الذي يدفع المشترين الأوروبيين إلى تبني الحلول المحلية في عام 2026 هو اللائحة العامة لحماية البيانات (GDPR) بالإضافة إلى القواعد القطاعية (مثل قانون تسجيل البيانات الرقمية، وتوجيه أمن الشبكات والمعلومات، وقانون الذكاء الاصطناعي، ولائحة الأجهزة الطبية). إرسال بيانات شخصية أو سجلات طبية أو أسرار صناعية إلى نقطة نهاية مستضافة في الولايات المتحدة يُعدّ مشكلة تعاقدية بغض النظر عن السعر. لا تعني وحدات التخزين الخاصة بمنطقة الاتحاد الأوروبي بالضرورة أنها خاضعة لسيطرة الاتحاد الأوروبي. بالنسبة للمشتري الخاضع للتنظيم، لا تُعتبر تكلفة الحلول المحلية الإضافية عبئًا، بل هي ثمن الحصول على ترخيص قانوني للنشر.

الحد الأدنى لزمن الاستجابة. تضيف شبكة WAN إلى أقرب نقطة نهاية مستضافة زمن استجابة يتراوح بين 15 و40 مللي ثانية داخل الاتحاد الأوروبي، وبين 80 و120 مللي ثانية عبر المحيط الأطلسي. أما في الشبكة المحلية على شبكة LAN بسرعة 10 جيجابت إيثرنت، فيكون زمن الاستجابة أقل من مللي ثانية. بالنسبة للمحادثات التفاعلية، يكون فرق زمن الاستجابة عبر شبكة WAN غير ملحوظ مقارنةً بزمن الاستجابة الكلي البالغ 800 مللي ثانية. بالنسبة لحلقة التحكم في الروبوتات (I01) أو وكيل صوتي أقل من 300 مللي ثانية، فإن الشبكة الواسعة (WAN) قاتلة.

التخصيص. توفر واجهات برمجة التطبيقات السحابية النموذج والكمية التي يختارها الموفر. أما في بيئة التشغيل المحلية، فتختار النموذج والكمية ومجموعة أدوات الخدمة (vLLM، SGLang، llama.cpp) ومحولات LoRA ووحدة فك التشفير التخميني. بالنسبة لمختبرات الأبحاث أو المنتجات المتخصصة، هذا ما تشتريه - وتُعتبر تكلفة وحدة Mtok ثانوية.

إذا لم ينطبق أيٌّ من هذه الشروط، فإنّ المشتري يُفضّل استخدام خدمة سحابية بتكلفة أقل من نقطة التعادل. ليس كل عميل محتمل مُناسبًا لشراء خادم.

القرار المتخذ: عبء عمل من الفئة 70B بحجمين

ملف تعريف العميل: برنامج SaaS يقوم بتصنيف وتلخيص المستندات، مدخلات/مخرجات بنسبة 70/30، نموذج مفتوح الوزن من الفئة 70B.

خيار بمعدل 100 مليون توكوفيرول شهريًا (3 سنوات) بمعدل 2 مليار توكوفيرول شهريًا (3 سنوات)
معًا (لاما 3.3 70 ب) €2,916 €58,320
AWS Bedrock (Llama 3.3 70B) €2,412 €48,240
كلود سونيت 4.6 (مرجع الحدود) €21,996 €439,920
4× 5090 في الموقع (مستهلك) €27,000 €27,000
لامدا 8× H100 مُستضافة ذاتيًا €389,000 €389,000

عند استخدام 100 مليون رمز مميز شهريًا، يتفوق Bedrock بشكل كبير على الحلول المحلية؛ ولم يحصل العميل على ما يستحقه. عند استخدام 2 مليار رمز مميز شهريًا، تتفوق الحلول المحلية بشكل حاسم بنسبة 1.8 إلى 2.2 ضعف حتى مقارنةً بأرخص بديل مُستضاف. بلغت نقطة التعادل لهذا الحجم من العمل حوالي 800 مليون إلى 1.2 مليار رمز مميز شهريًا. أقل من ذلك، يُنصح بالاستئجار. أكثر من ذلك، يُنصح بالتملك.

مصفوفة القرار

الحجم / الشهري نموذج 8B–13B نموذج 32 ب نموذج 70 ب فرونتير (كلود / جي بي تي-5)
< 100 مليون توك سحابة API سحابة API سحابة API سحابة API
100-500 مليون توك واجهة برمجة تطبيقات السحابة أو 4× الطبقة الرابعة سحابة API سحابة API سحابة API
500 م – 1 ب 4-8× L4 محليًا 4× 5090 أو سحابة كلاود (بيدروك/معاً) سحابة API
1-5 ب توك 8× L4 محلي 4 × 5090 4× 5090 أو 4× Pro 6000 SE هجين سحابي + محلي
5-50 ب توك مجموعة 8× L4 4× برو 6000 بي دبليو إس إي 4–8× Pro 6000 BW SE Frontier Cloud + مستودع محلي
> 50 B tok شبكة متعددة العقد من الطبقة الرابعة 8× برو 6000 بي دبليو إس إي 8× برو 6000 إس إي × إن أسعار المؤسسات + هجين

في النهج المحافظ، يُقدّم المشتري الخاضع للرقابة عمود "الأنظمة المحلية" صفًا واحدًا، بينما يُؤخّره المشتري التجريبي صفًا واحدًا. أما عمود "الأنظمة الرائدة" فهو مميز: لا يوجد نظام محلي بديل لـ Claude Opus 4.7 أو GPT-5. فهذه وحدات تخزين عالية الجودة تُستخدم عند الحاجة، وليست أحمال عمل تُستضاف.

الرأي الصريح

معظم العملاء المحتملين الذين يظنون أنهم بحاجة إلى خادم ليسوا كذلك. عند الأحجام المعتادة - من 5 إلى 50 مليون رمز مميز شهريًا لمنتج في مراحله الأولى، ومن 50 إلى 500 مليون لمرحلة متوسطة - تظل واجهات برمجة التطبيقات السحابية هي الخيار الأمثل لمدة تتراوح بين 12 و24 شهرًا. الحل الأمثل هو: "استخدم Together أو Bedrock، وراقب إنفاقك الشهري، واتصل بنا عندما يتجاوز 1,500 يورو شهريًا بشكل مستدام."

ينقسم المشترون الذين يعتبرون الحلول المحلية منطقية في عام 2026 إلى ثلاثة أشكال. ينظملا يمكن للبيانات مغادرة المبنى. مستدام على نطاق واسع: 1 مليار رمز مميز شهريًا على نموذج من فئة 70 مليار حيث تفوز الرياضيات بمقدار 2-3 أضعاف. الروبوتات أو زمن الاستجابة المنخفضيُعيق استخدام شبكة WAN الأساسية التطبيق. حوالي 30-40% من عملائنا المحتملين يناسبهم هذا الحل. أما بالنسبة للنسبة المتبقية (60-70%)، فإن واجهات برمجة التطبيقات السحابية (APIs) في عام 2026 تُعدّ منتجًا رائعًا، وينبغي عليهم الاستمرار في استخدامها حتى تتغير الظروف.

التدريب موضوع مختلف. تقريبًا كل عبء عمل على نطاق الذكاء الاصطناعي المعرفي (LoRA، QLoRA، ضبط دقيق من 7 إلى 32 مليار) أرخص محليًا من استئجار وحدة معالجة الرسومات السحابية - حيث يعمل الجهاز بكامل طاقته أثناء التشغيل. الاستثناء هو التدريب على نطاق واسع جدًا (التدريب المسبق الكامل لأكثر من 70 مليار، RLHF على نطاق واسع) حيث تحتاج إلى 8 وحدات H100 مع NVLink، والتي لا نبيعها (W07 (يشرح السبب). استأجره، شغّله، وأحضر الأوزان إلى المنزل.

ماذا تفعل بعد ذلك

قم بتنفيذ هذه الخطوات قبل التحدث إلى البائع:

  1. قياس حجم الرموز المميزة الشهري الحالييتم تقسيمها حسب مستوى النموذج. إذا لم تتمكن من ذلك، فقم بتجهيزها لمدة أسبوعين. بدون هذا الرقم، ستكون كل خطوة لاحقة مجرد تخمين.
  2. المشروع على مدى ستة أشهر، على الأقل — اضرب في 1.5–2. تنمو فواتير LLM بشكل أسرع من الناتج لأن السياقات تتوسع ويضيف الوكلاء خطوات.
  3. حدد المستويات بصدق. هل يحتاج جزء من البيانات إلى جودة فائقة؟ هل يعمل جزء البيانات بشكل جيد على Sonnet 4.6 / GPT-5 mini؟ هل يعمل جزء البيانات بشكل جيد على Llama 3.3 70B؟ التوزيع النموذجي: 5% / 25% / 70%.
  4. فاتورة الحوسبة السحابية بالحجم المتوقع حسب المستوى من الجدول أعلاه. هذا هو منافسك.
  5. الحوسبة المحلية لصندوق 4× 5090 أو 4× Pro 6000 SE عند مستوى الصوت المتوقع باستخدام T01.
  6. إذا تجاوزت احتياجات الحوسبة السحابية احتياجات البنية التحتية المحلية بأقل من 1.5 ضعف، فابقَ على الحوسبة السحابية. العمليات، ووقت التوقف، ومخاطر الإنفاق الرأسمالي تلتهم المكاسب الصغيرة.
  7. إذا تجاوزت الحوسبة السحابية الحوسبة المحلية بمقدار الضعف أو أكثر، فإن حالة الحوسبة المحلية حقيقية. تصبح السيادة، وزمن الاستجابة، والتخصيص عوامل حاسمة - فهي تعزز دائماً تقريباً الحلول المحلية على هذا النطاق.
  8. إذا كان الأمر خاضعًا للتنظيم أو مرتبطًا بزمن الاستجابة، فتجاوز الحسابات. أنت تشتري من المتجر مباشرةً بغض النظر عن ذلك. حدد الحجم مع T01 و W07.

المتابعة T03 مقارنة الأداء المستدام مقابل الأداء المتقطع - متى يكون الحل الهجين مناسبًا، وكيفية تحديد حجم البنية التحتية الأساسية في الموقع مع إمكانية تجاوز سعة التخزين السحابية. مراجع ذات صلة: T01 (تكلفة الملكية الإجمالية لكل وحدة معالجة رسومية وتوك/ثانية)، W07 (اختيار وحدة معالجة الرسومات)، I04 (الحسابات الكهربائية على جانب الجدار وراء افتراض €/كيلوواط ساعة).

جملة واحدة يجب تذكرها: لا توجد إجابة عامة لسؤال تكلفة المليون رمز مميز - بل توجد إجابة محددة بناءً على حجم العمل وحجمه ومستوى النموذج وسعر الكهرباء في بلدك. قم بحساب الأرقام قبل توقيع أي شيء.