OpenAI سیستم ارزیابی امنیت قرارداد هوشمند را راه اندازی کرد
OpenAI سیستم جدیدی به نام EVMbench را معرفی کرده است که برای اندازهگیری اینکه چگونه عوامل هوش مصنوعی میتوانند نقصهای امنیتی در قراردادهای هوشمند کریپتو را پیدا کنند و رفع کنند، طراحی شده است.
خلاصه
- OpenAI EVMbench را معرفی کرده است، یک چارچوب جدید که برای اندازهگیری اینکه چگونه عوامل هوش مصنوعی میتوانند آسیبپذیریهای قرارداد هوشمند را شناسایی، رفع و از آنها بهرهبرداری کنند، طراحی شده است.
- معیار توسعه یافته با پارادایم بر روی داده های حسابرسی واقعی ساخته شده است و بر سناریوهای امنیتی عملی و پرخطر تمرکز دارد.
- در حالی که نتایج اولیه پیشرفت قوی در وظایف بهره برداری را نشان می دهد، تشخیص و وصله کردن همچنان چالش برانگیز است.
این شرکت در 18 فوریه اعلام کرد که در حال توسعه EVMbench با مشارکت Paradigm است. این معیار بر قراردادهای ساخته شده برای ماشین مجازی اتریوم تمرکز دارد و هدف آن آزمایش نحوه عملکرد سیستمهای هوش مصنوعی در محیطهای مالی واقعی است.
OpenAI گفت قراردادهای هوشمند اکنون بیش از 100 میلیارد دلار از داراییهای رمزنگاری منبع باز را تضمین میکنند و تستهای امنیتی با توانمندتر شدن ابزارهای هوش مصنوعی اهمیت فزایندهای پیدا میکنند.
آزمایش نحوه برخورد هوش مصنوعی با خطرات امنیتی واقعی
EVMbench عوامل هوش مصنوعی را در سه وظیفه اصلی ارزیابی می کند: شناسایی آسیب پذیری ها، رفع کد معیوب و انجام حملات شبیه سازی شده. این سیستم با استفاده از 120 موضوع پرخطر از 40 ممیزی امنیتی گذشته، عمدتاً از مسابقات ممیزی عمومی ساخته شده است.
سناریوهای اضافی از بررسی بلاک چین Tempo، یک شبکه متمرکز بر پرداخت طراحی شده برای استفاده از استیبل کوین، استخراج شد. این موارد برای نشان دادن نحوه استفاده از قراردادهای هوشمند در برنامه های مالی گنجانده شده است.
برای ایجاد بستر آزمایشی، OpenAI اسکریپت های اکسپلویت موجود را تطبیق داد و در صورت نیاز اسکریپت های جدید ایجاد کرد. تمام آزمایشهای بهرهبرداری به جای شبکههای زنده بر روی سیستمهای ایزوله انجام میشوند و تنها آسیبپذیریهایی که قبلا فاش شدهاند شامل میشوند.
در حالت تشخیص، ماموران کد قرارداد را بررسی می کنند و سعی می کنند نقص های امنیتی شناخته شده را شناسایی کنند. در حالت پچ باید این ایرادات را بدون شکستن نرم افزار برطرف کنند. در حالت بهره برداری، کارگزاران تلاش می کنند تا وجوه قراردادهای آسیب پذیر را در یک محیط کنترل شده تخلیه کنند.
نتایج اولیه و تاثیر صنعت
OpenAI گفت یک چارچوب تست اختصاصی برای اطمینان از تکرار و اعتبارسنجی نتایج ایجاد شده است.
این شرکت بسیاری از مدل های پیشرفته را با استفاده از EVMbench آزمایش کرده است. در حالت بهره برداری، GPT-5.3-Codex به امتیاز 72.2% در مقایسه با 31.9% برای GPT-5 که شش ماه پیش منتشر شد، دست یافت. نمرات تشخیص و وصله پایینتر نشان میدهد که رفع بسیاری از آسیبپذیریها هنوز توسط سیستمهای هوش مصنوعی دشوار است.
محققان مشاهده کردهاند که وقتی اهداف مشخص هستند، مانند کاهش سرمایه، کارگزاران بهترین عملکرد را دارند. زمانی که کارها به تجزیه و تحلیل عمیق تری نیاز داشتند، مانند بررسی پایه های بزرگ کد یا رفع اشکالات ظریف، عملکرد کاهش یافت.
OpenAI تصدیق کرد که EVMbench به طور کامل شرایط دنیای واقعی را منعکس نمی کند. بسیاری از پروژههای رمزنگاری بزرگ نسبت به پروژههای موجود در مجموعه دادهها، تحت بررسیهای گستردهتری قرار میگیرند. برخی از حملات مبتنی بر زمان بندی و چند زنجیره ای نیز خارج از محدوده سیستم هستند.
این شرکت گفت که هدف این معیار حمایت از استفاده دفاعی از هوش مصنوعی در امنیت سایبری است. با قدرتمندتر شدن ابزارهای هوش مصنوعی، مهاجمان و حسابرسان می توانند از آنها استفاده کنند. اندازه گیری قابلیت های آنها به عنوان راهی برای کاهش ریسک و تشویق استقرار مسئولانه دیده می شود.
در کنار انتشار، OpenAI گفت که برنامه های امنیتی خود را گسترش داده و 10 میلیون دلار در اعتبارات API برای حمایت از منبع باز و حفاظت از زیرساخت سرمایه گذاری می کند. همه ابزارها و مجموعه داده های EVMbench برای حمایت از تحقیقات بیشتر در دسترس عموم قرار گرفته اند.

