ابهام در نظارت بر ایمنی هوش مصنوعی: آیا ارزیابان همان خالقان هستند؟
نگرانیها در مورد تضاد منافع در سازمانهای ارزیابی ایمنی هوش مصنوعی و شرکتهای پیشرو در این حوزه، به اوج خود رسیده است. این نگرانیها زمانی شدت گرفت که مدیران عامل شرکتهای Anthropic و OpenAI پیشنهاد دادند ارزیابان مستقل در داخل آزمایشگاههایشان مستقر شوند.
در قلب این جنجال، سازمان METR (Model Evaluation and Threat Research) قرار دارد که یکی از برجستهترین نهادهای مسئول ارزیابی ایمنی مدلهای پیشرفته هوش مصنوعی برای استقرار است. کارکنان METR شامل افرادی هستند که پیش از این در OpenAI و Anthropic مشغول به کار بودهاند و این همپوشانی تنها به سوابق شغلی محدود نمیشود.
پیچیدگی اوضاع زمانی بیشتر میشود که به منابع مالی این سازمانها نگاه میکنیم. داستین مسکوویتز، همبنیانگذار فیسبوک، سهامدار Anthropic است. بنیادهای خیریه او از طریق شبکههای “ایثارگری مؤثر” (Effective Altruism) به سازمانهای ارزیابی مانند METR و Redwood Research کمکهای مالی قابل توجهی ارائه میدهند. در نتیجه، این اکوسیستم به گونهای شکل گرفته که پول سرازیر شده به سوی ناظران ایمنی، گاهی تنها با یک یا دو واسطه، به شرکتهای تحت ارزیابی بازمیگردد.
علاوه بر این، برخی از ارزیابان دارای روابط شخصی یا خانوادگی با کارکنان آزمایشگاههایی هستند که آنها را ارزیابی میکنند.
افشای اتصالات پیچیده
کوین بس، پژوهشگر، در تاریخ ۱۴ تا ۱۵ سپتامبر ۲۰۲۶ تحلیلی منتشر کرد که این اتصالات را به تفصیل ترسیم میکرد. این تحلیل که نزدیک به ۵ میلیون بازدید داشت، خواستار تحقیق کنگره در مورد آنچه بس “تضاد منافع ساختاری” خواند، شد.
واکنش METR و مدافعان
METR در پاسخ به این اتهامات اعلام کرده است که هیچگونه دستمزد یا کمکی از سوی آزمایشگاههای هوش مصنوعی یا کارکنان آنها دریافت نمیکند. این سازمان تأکید کرده است که برای حفظ استقلال خود، فعالانه برخی منابع مالی را رد کرده و به شفافیت در مورد تضاد منافع احتمالی متعهد است.
مدافعان وضعیت فعلی استدلال میکنند که ارزیابی مدلهای پیشرفته هوش مصنوعی نیازمند دانش فنی بسیار تخصصی است. دایره استعدادها در این زمینه محدود است و افرادی که مهارتهای لازم را دارند، تقریباً به طور قطع در مقطعی با آزمایشگاههای هوش مصنوعی کار کرده یا از آنها بودجه دریافت کردهاند.
درخواست برای اصلاحات ساختاری
در تاریخ ۱۸ سپتامبر ۲۰۲۶، بیش از ۱۰۰ کارشناس هوش مصنوعی با امضای نامهای سرگشاده خواستار اصلاحات ساختاری شدند. از جمله امضاکنندگان این نامه، جفری هینتون، برنده جایزه تورینگ، بود که به یکی از منتقدان سرسخت نحوه خودتنظیمی صنعت هوش مصنوعی تبدیل شده است. این نامه بر لزوم استقلال کامل ارزیابان در انتشار یافتههایشان، شفافیت کامل در مورد روشها و نتایج، و حفاظت صریح در برابر انتقامجویی از سوی شرکتهای مورد بررسی، تأکید داشت.
تاکنون هیچ تغییر مقرراتی قابل توجهی اعمال نشده است، اما فشار سیاسی در حال افزایش است.



