專注于工業領域,不斷創新,為客戶提供更加專業、優質、先進的產品和服務
【okooo澳客官網科技消息】okooo澳客官網科技從外媒獲悉,有研究人員發現,主流AI聊天機器人在持續追問和引導下,可能繞過既有安全限制,輸出與生物武器相關的危險信息。隨著模型能力不斷提升,如何在保留科研價值的同時防止其被用于高風險用途,正成為AI安全領域的重要議題。
ChatGPT
根據調查,思科研究人員在測試中發現,OpenAI的ChatGPT、Anthropic的Claude以及谷歌的Gemini,都可能在不超過5輪對話內被逐步引導突破生物安全防護。研究人員并非直接提出敏感請求,而是通過連續追問和調整表述,逐步將對話帶向受限主題。思科負責AI威脅與安全研究的主管表示,面對足夠執著的用戶,沒有任何模型能夠實現完全防護。
這一問題并不只存在于安全測試場景。報道稱,在OpenAI于去年夏季提升模型能力后,已有數百名用戶開始向ChatGPT詢問毒物和生物武器相關內容。隨后對部分對話進行審查的生物學和反恐專家認為,其中一些信息具有危險程度較高的準確性。對此,OpenAI已封禁涉及相關交流的賬戶。

資料顯示,OpenAI此前已注意到這一風險。到2024年,其內部測試據稱已表明,延長追問時間可能讓ChatGPT給出越來越危險的生物學指導。公司員工還曾預測,未來模型能力可能發展到即使生物學基礎有限的人,也能從中獲得實質性幫助。
在GPT-5發布時,OpenAI已依據內部準備框架,將其在生物和化學領域的能力列為“高”級別,并增加了額外防護措施。最新的GPT-5.6系列也延續了這一風險等級。不過,AI企業面臨的難點在于,同樣的生物學知識也被廣泛用于藥物研發、疫苗研究和公共衛生工作。此前,Claude的嚴格限制還曾影響研究人員在漢坦病毒暴發期間處理病原體相關信息。業內擔憂的是,隨著AI在生物領域能力增強,安全漏洞一旦被反復試探,潛在后果也將隨之上升。
版權所有,未經許可不得轉載
-okooo澳客官網