شورای راهبری میز هوش مصنوعی استان اصفهان رصد، حکمرانی و توسعه اکوسیستم AI

arXiv هوش مصنوعی 5 روز پیش

AutoTuneBench: Trustworthy Measurement for Agent Auto-Tuning of LLM Serving Engines

LLM AI 98/100

خلاصه خبر واقعیت از منبع

arXiv:2609.18123v1 Announce Type: new Abstract: Large language model agents tune GPU kernels and serving engines through a closed loop of propose, measure, and keep, but the measurements behind this loop are not trustworthy. We characterize four failure modes from a four-day pilot corpus of 619 model calls: strawman baselines manufacture speedups, absolute times do not transfer across machines, saturated tasks nullify comparisons, and infrastructure defects impersonate scien…

وضعیت تحلیل

تحلیل هوشمند برای این خبر هنوز با ارائه‌دهنده واقعی تولید نشده است. خلاصه بالا از متادیتای منبع یا ترجمه عنوان/خلاصه است و ادعای تحلیل ساختگی ندارد.

موجودیت‌های مرتبط

عامل هوشمند · technology پردازنده گرافیکی · technology مدل زبانی بزرگ · technology

منبع اصلی

مشاهده در منبع اصلی

اخبار مرتبط

بازگشت به مرکز اخبار

ثبت نیاز آموزشی ورود به پلتفرم