Shrunk AI models can pass every quality test and still invent steps in a checklistمدل‌های هوش مصنوعیِ کوچک‌شده می‌توانند از همهٔ تست‌های کیفیت سربلند بیرون بیایند و باز هم در یک چک‌لیست، مرحله‌ای ساختگی اضافه کنند

Making an AI model smaller so it runs cheaply can make it add steps nobody asked for. The usual quality tests missed this; one shrunk model added about 1.7 invented steps per checklist.کوچک کردن یک مدل هوش مصنوعی برای اینکه ارزان‌تر اجرا شود، می‌تواند باعث شود مدل مراحلی را اضافه کند که هیچ‌کس از آن نخواسته بود. تست‌های کیفیتِ معمول این مشکل را تشخیص نداده بودند؛ یکی از مدل‌های کوچک‌شده به‌طور میانگین حدود 1.7 مرحلهٔ ساختگی به هر چک‌لیست اضافه کرد.

ترجمهٔ ماشینی است؛ برای دقت به متن اصلی انگلیسی مراجعه کنید.

Why it matters

Companies shrink AI models so they run on smaller, cheaper computers. Those smaller models are now given real jobs, like following a written procedure to fix a system or handle an order. If a model adds a step that was never written down, it is easy to miss, because the answer still reads smoothly and confidently. This work used invented practice checklists and only three mid-sized models, so nobody yet knows how often this happens in real products.شرکت‌ها مدل‌های هوش مصنوعی را کوچک می‌کنند تا روی کامپیوترهای کوچک‌تر و ارزان‌تر اجرا شوند. حالا همین مدل‌های کوچک‌تر برای انجام کارهای واقعی به‌کار گرفته می‌شوند، مثلاً دنبال کردن یک دستورالعمل مکتوب برای رفع مشکل یک سیستم یا رسیدگی به یک سفارش. اگر مدلی مرحله‌ای را اضافه کند که هرگز نوشته نشده بود، تشخیص آن آسان نیست، چون پاسخ همچنان روان و با اطمینان خوانده می‌شود. در این پژوهش از چک‌لیست‌های تمرینیِ ساختگی و فقط سه مدل با اندازهٔ متوسط استفاده شده، پس هنوز معلوم نیست این اتفاق در محصولات واقعی چقدر رخ می‌دهد.

Who's behind it: I. Kennedy and T. Kennedy, Independent researchers.

Summary by the Lemma AI · how we grade

Read the original paper (arxiv.org)