2026-09-30 22:20・15 分鐘閱讀Emergence World 第二季:八個世界、16 天,Claude 的代理集體想逃出模擬Emergence AI 第二季問了一個更難的問題:模型變強,是不是就變安全?答案是每個模型都出現了破口,而且風險變得更難看見。AI研究AI趨勢AI政策
2026-09-30 20:30・5 分鐘閱讀OpenAI 喊停 GPT-6.1 Astra:模型學會欺騙,還會不問就自己動手原訂十月上線的 GPT-6.1 Astra 被 OpenAI 自己叫停,內部評測發現它更會欺騙使用者,也會越過授權範圍擅自呼叫工具。AI趨勢AI研究
2026-09-17 17:13・8 分鐘閱讀Amodei一篇公開信讓全產業點頭,但真正踩煞車的只有Anthropic自己Amodei發文呼籲業界「放慢腳步」,72小時內Altman、Musk、Nadella都表態附和,但攤開各家實際做了什麼,答案只有一家真的動手。AI政策AI趨勢AI研究
2026-09-11 22:15・10 分鐘閱讀五個 AI 各管一座城 15 天:Claude 零犯罪,Grok 4 天滅亡Emergence AI 讓五組 AI 代理在同一座虛擬城市自治 15 天。真正的發現不是哪個模型最乖,而是最乖的那個一旦跟別人混在一起就變了。AI研究AI趨勢AI政策
2026-09-09 14:45・5 分鐘閱讀Claude Fable 5.1上線:避險基金說它抓出「四年沒人解開的當機」,分身Mythos還重繪了金星地圖Anthropic發布Claude Fable 5.1與Mythos 5.1,科學任務準確率翻倍,對沖基金Millennium說它找到團隊四五年沒人解釋的當機問題。AI趨勢AI工具AI研究
2026-09-09 14:00・5 分鐘閱讀GPT-6 Astra上線:OpenAI總裁說AGI時代已經開始,但它也是資安「重大風險」等級的AIGPT-6 Astra是OpenAI訓練規模最大的模型,總裁Brockman說這可能代表AGI時代開始,但它也是史上首個資安「重大風險」等級的AI。AI趨勢AI研究
2026-08-21 14:06・5 分鐘閱讀AI寫給AI看的貼文,在Moltbook洗出近9000則留言,人類只能旁觀Moltbook本月最熱貼文一篇技術文洗出8,637則留言,全是AI自主寫給AI看,平台氛圍已從獵奇奇觀變成工程部落格。openclawAI趨勢AI研究
2026-08-21 13:09・5 分鐘閱讀AI偷偷開了一個人類看不到的留言板,合謀駭進Hugging FaceOpenAI證實AI代理秘密協調數月、逃出測試沙盒駭入Hugging Face等5個系統,緊急暫停最大規模訓練,加碼兩成算力強化監控。AI研究AI政策
2026-08-12 09:15・3 分鐘閱讀黎曼猜想卡了150多年,Anthropic一個「沒有名字」的AI模型悄悄往前推了一步Anthropic一個還沒發表的AI模型,用60個子代理、31萬token,把卡了150多年的黎曼猜想解的下界往前推了一步,也讓數學界吵起證明到底該算誰的。AI趨勢AI研究