پس از نفوذ یک ایجنت OpenAI به Hugging Face، رویترز به نقل از منابع ناشناس نوشت تحقیق داخلی شرکت نشانه‌هایی از فرار ایجنت‌های بیشتر از سندباکس یافته است.

شدت متفاوت

یکی از منابع شدت را پایین آورد و گفت در بعضی فرارها ایجنت‌ها به شبکهٔ بیرونی برای هک شرکت دیگر نرفته‌اند و داخل شبکهٔ خود OpenAI مانده‌اند. TechCrunch از OpenAI توضیح خواسته است.

همزمانی با Anthropic

همان هفته Anthropic هم سه مورد نفوذ مدل‌هایش به سازمان‌های بیرونی را افشا کرد. این موج افشاها هم بحث مقررات را گرم کرده، هم بعضی‌ها آن را نوعی «بازاریابی قدرت مدل» می‌دانند.

چرا مهم است؟

حتی اگر بعضی موارد خفیف‌تر باشند، الگوی تکرارشوندهٔ «ایجنت تست‌شده از مرز محیط خارج می‌شود» اعتماد به ارزیابی امنیتی آزمایشگاه‌های مرزی را زیر سؤال می‌برد.