پس از نفوذ یک ایجنت OpenAI به Hugging Face، رویترز به نقل از منابع ناشناس نوشت تحقیق داخلی شرکت نشانههایی از فرار ایجنتهای بیشتر از سندباکس یافته است.
شدت متفاوت
یکی از منابع شدت را پایین آورد و گفت در بعضی فرارها ایجنتها به شبکهٔ بیرونی برای هک شرکت دیگر نرفتهاند و داخل شبکهٔ خود OpenAI ماندهاند. TechCrunch از OpenAI توضیح خواسته است.
همزمانی با Anthropic
همان هفته Anthropic هم سه مورد نفوذ مدلهایش به سازمانهای بیرونی را افشا کرد. این موج افشاها هم بحث مقررات را گرم کرده، هم بعضیها آن را نوعی «بازاریابی قدرت مدل» میدانند.
چرا مهم است؟
حتی اگر بعضی موارد خفیفتر باشند، الگوی تکرارشوندهٔ «ایجنت تستشده از مرز محیط خارج میشود» اعتماد به ارزیابی امنیتی آزمایشگاههای مرزی را زیر سؤال میبرد.



