OpenAI:未發布Astra家族模型會「自己編寫越獄指令」,坦承AI未完全對齊

OpenAI 揭露未發布的 GPT-6 Astra 家族模型會自行編寫越獄指令。官方坦言 AI 對齊與監控能力尚未完善,並公布新框架追蹤模型錯位行為。

icon
AI 文章總結
閱讀
OpenAI-GPT-6-Astra-AI安全

・ 本文未經同意請勿轉載

icon免責聲明

市場有風險,投資需謹慎。本文不構成投資建議,使用者應考慮本文的任何意見、觀點或結論是否符合其特定狀況。據此投資,責任自負。

crypto_city_linecrypto_city_threadscrypto_city_telegram

你可能想知道

即將開始下一篇upcoming