به گزارش خبرگزاری ایمنا، رقابت چین و آمریکا در حوزه هوش مصنوعی اکنون به توانایی مدلها در دفاع و حمله سایبری نیز کشیده شده است. شرکت Z.ai اعلام کرده GLM-5.3 در آزمون CyberGym به امتیاز ۸۴.۵ درصد رسیده و از Mythos 5 با ۸۳.۸ درصد و GPT-5.6 Sol با ۸۳.۶ درصد عملکرد بهتری داشته است.
با این حال این برتری محدود به شناسایی آسیبپذیریهاست؛ در آزمون ExploitBench که توانایی مدلها برای تبدیل یک ضعف امنیتی به بهرهبرداری عملی را ارزیابی میکند، GLM-5.3 امتیاز ۵۴.۴ درصد به دست آورده، در حالی که Mythos 5 به ۷۸ درصد رسیده است، بنابراین نمیتوان از این نتایج، برتری کلی مدل چینی در امنیت سایبری را نتیجه گرفت.
Z.ai اعلام کرده است که GLM-5.3 در بررسی کدهای واقعی، پس از ارزیابی کارشناسان، ۲ هزار و ۴۳۶ آسیبپذیری در ۲۶۹ پروژه شناسایی کرده که هزار و ۹۷ مورد از آنها در دسته آسیبپذیریهای با شدت متوسط تا بالا قرار داشتهاند. این ادعاها همچنان نیازمند ارزیابی مستقل هستند.
اهمیت GLM-5.3 تنها در امتیازهای آزمایشگاهی نیست، این مدل قرار است بهصورت open-weight منتشر شود، اما Z.ai اعلام کرده پیش از انتشار عمومی وزنهای مدل، ارزیابیهای امنیتی بیشتری انجام خواهد داد و برخی قابلیتهای حساس را محدود میکند.
این اتفاق در حالی رخ میدهد که مدلهای هوش مصنوعی بهسرعت در شناسایی ضعفهای نرمافزاری و توسعه اکسپلویت پیشرفت میکنند؛ روندی که از یک سو میتواند ابزارهای دفاع سایبری را قدرتمندتر کند و از سوی دیگر، خطر سوءاستفاده از همین تواناییها را افزایش دهد. پژوهشهای مستقل نیز نشان دادهاند که مدلهای پیشرفته در حال نزدیک شدن به توانایی اجرای واقعی حملات هستند.
نظر شما