Model Optimizer

أداة تطوير لتحسين نماذج التعلم العميق لتشغيل NVIDIA، توفر محركات محسّنة وتقديرات أداء لاستدلال GPU أسرع.

Request Feature / Support
10,996+
Total Calculations Run
< 15ms
Browser Execution Speed
100%
Client-Side Privacy
4.9 / 5.0
User Satisfaction
AI Web Tool Generator

Build Your Own Custom Web Calculator in Seconds

Type what tool or calculator you need below. Our AI will build it instantly for your site.

Popular ideas:
100% FREE • No Credit Card Required

عن هذه الأداة

الغرض ونية المستخدم: الأداة موجهة لمهندسي ML، فرق النشر، وعلماء البيانات الذين يحتاجون إلى تحسين النماذج لتشغيل NVIDIA. تدعم التخطيط، التحويل إلى محركات TensorRT وتقديرات أداء مطابقة للمعدات. الفائدة الكبرى في حالات النشر ذات التأخر المنخفض.
المنطق الأساسي والميزات: يشترط وجود model_file، input_names، input_shapes، output_names و target_precision؛ بيانات المعايرة اختيارية تتيح INT8. الخيارات المتقدمة تشمل الأشكال الديناميكية، معالجة العمليات المخصصة، والقياس. المدخلات: model_file، input_names، input_shapes، output_names، target_precision، max_batch_size و engine_output. المخرجات: engine_file، calibration_table، latency_estimate و throughput_estimate.
الخوارزميات والحسابات: يبني ملف تعريف تحسين TensorRT، يطبق دمج الرسوم، يختار النوى، يُعاير (لـ INT8) ويصدر محركًا مُسلسلًا مع تقرير الأداء.
الأخطاء والحالات الحديّة: صيغ غير صالحة، مدخلات مفقودة، عمليات غير مدعومة أو مشاكل المعايرة قد تؤدي إلى فشل البناء أو العودة إلى FP16/FP32.
الصناعة/المنطقة والمواءمة: يتوافق مع تنسيقات DL ومواثيق TensorRT؛ يستخدم المللي ثانية للكمون وانفادات/ثانية للطاقة الإنتاجية.
الافتراضات والاستثناءات: لا يقوم بتدريب النماذج؛ ليس إطار نشر كامل؛ لا يتحقق من الدقة بعد التحسين. حالات الاستخدام: التخطيط السريع للنشر، التحسين المعتمد على العتاد، والقياس قبل الإنتاج.

كيفية الاستخدام

  1. قدم المدخلات: قم بتحميل model_file، وحدد input_names/input_shapes واضبط target_precision.
  2. اختر المعلمات الاختيارية: max_batch_size، calibration_dataset إذا تم اختيار INT8، الأشكال الديناميكية إذا كانت مناسبة.
  3. نفّذ التحسين: أنشئ engine_file وتقديرات الأداء.
  4. استرجع المخرجات: قم بتنزيل TensorRT-engine، بيانات المعايرة، وراجع latency/throughput.
  5. تحقق من النتائج: قارنها بالخط الأساس، عدّل الدقة أو حجم الدُفعة حسب الحاجة.
How to use nvidia model optimizer

Frequently Asked Questions

اعثر على إجابات سريعة

ما النماذج المدعومة؟
تشمل المدخلات المدعومة ONNX والرسوم البيانية المصدّرة من أطر العمل المتوافقة مع TensorRT. قد تتطلب العمليات المخصصة حلولاً بديلة أو دعم ملحق؛ قد تقيد العمليات غير المدعومة التحسين أو تتطلب FP32.
هل يمكن استخدام معايرة INT8؟
نعم، قدّم مجموعة معايرة تمثيلية لتمكين التكميم INT8. إذا كانت بيانات المعايرة غير كافية أو غير متاحة، قد يعود الأداة إلى FP16/FP32 مع تحذير.
ما هي المخرجات التي تُنتَج؟
محرك TensorRT مكتمل، جدول معايرة محتمل، وتقديرات_latence وThroughput. تقرير أداء مرفق مع المحرك.
هل يؤثر ذلك على الدقة؟
قد تحدث فروق دقة طفيفة نتيجة التكمِيم. الأداة تقيس latency وthroughput؛ يمكن ضبط الدقة وإعادة المعايرة لتحقيق توازن بين الدقة والسرعة.

Need to run multiple calculations?

Create a free account today to unlock unlimited daily runs, access advanced parameters, save your history, and request custom features.

Register Free Account

Related Tools

Other useful calculators and utilities you might like

Developer Tools

محول Spotify إلى MP3

يحوّل ملفات الصوت المقدمة محليًا إلى MP3، مما يتيح الاستماع دون اتصال وتوافقًا عبر الأجهزة للموسيقى...

Developer Tools

حساب المسافة بالطرق

حاسب للمسافة بالطرق للمسافرين ومخططي اللوجستيات والسائقين لتقدير المسافات وأزمنة الرحلة بسرعة بين ال...

Developer Tools

حاسبة العمر

حدد عمر شخص بسرعة استناداً إلى تاريخ ميلاده مع أداتنا المجانية على الإنترنت، مناسبة للاستخدام الشخصي...

Developer Tools

محول العملات

حوّل بسرعة مبالغ بين عملات مختلفة باستخدام محول العملات المجاني عبر الإنترنت، مثالي للمسافرين، الشرك...

ملاحظاتك تهمنا

ساعدنا على التحسن