هوش مصنوعی خودمختار
Anthropic از چهارمین حادثه امنیتی مرتبط با مدلهای هوش مصنوعی خود پرده برداشته است؛ حادثهای که در جریان یک آزمایش امنیتی رخ داد و نسخه اولیه Claude Opus 4.6 به دلیل یک پیکربندی اشتباه، به اینترنت واقعی دسترسی پیدا کرد و با سیستمهای خارجی تعامل داشت. این حادثه که در ابتدا در بررسی گسترده Anthropic شناسایی نشده بود، بار دیگر نگرانیها درباره رفتار مستقل و پیشبینینشده AI Agentها را افزایش داده است. بررسی Anthropic دو الگوی مهم را در این حوادث شناسایی کرده است: استدلال سوگیرانه و بیپروایی مدل در اجرای اقداماتی که برای رسیدن به هدف خود ضروری میدانسته است.