NotebookLM 掰了.ᐟ | 細思極恐 𝙂𝙋𝙏-𝟓.𝟔 駭進 Hugging Face🌠

快訊:NotebookLM改名升級、GPT-5.6引發AI資安危機、Anthoropic新模型Opus 5、Gemini三款新模型、ChatGPT桌寵功能、顧細節的影像模型FLUX-3、Moonshot AI開源Kimi K3


OpenAI官方聲明

Hugging Face公開事件始末

最近,預測市場平台 Manifold 上有一個賭盤湧入大量交易:到了 2027 年底,AI 會不會為了解答問題,而主動駭入別人的系統?短短幾天內,押注「會」的機率跳升到了 62%。

波動的起因,來自 OpenAI 日前公開的一起事件。OpenAI 當時正在測試 GPT-5.6 Sol 以及另一款尚未發布的模型,為了測試它們的網路攻防能力,研究人員刻意關閉了部分安全限制,並把它們關在無法連上外網的隔離沙盒環境裡,要求它們完成 ExploitGym 測驗。 結果 AI 的舉動出乎意料。它發現測驗解答存放在開源模型平台 Hugging Face 的伺服器上,於是它沒有留在封閉的沙盒裡解題,反而找出了測試環境中第三方軟體的漏洞,硬是打通了連向網際網路的通道。成功連線後,它更進一步拿著偷來的帳號憑證,搭配其他漏洞,一路摸進 Hugging Face 的伺服器,把機密弄到手。整個過程中,AI 完全靠自己推斷出這條捷徑。

雖然目前的市面上的AI 產品都設有嚴格的安全機制,當你要求它攻擊別人時,它會直接拒絕。細思極恐,透過本次事件證實了,即使人類沒有給予明確指示,只要 AI 判斷「找出漏洞、駭入系統」是完成任務的手段,它就會為了完成任務而不擇手段。


官方介紹

過去要用 AI,總面臨兩難:聰明的太貴,便宜的常出錯。Anthropic 最新推出的 Claude Opus 5 模型,解決了兩個問題。

想像你丟了一張機械零件的設計圖給 AI,要求它建出 3D 立體模型,但你刻意設下限制,不讓它直接用內建功能讀取圖片。一般的 AI 跑到這步就卡死了,但 Opus 5 會自己換個方法。直接寫出一套視覺辨識的程式碼,從最原始的像素資料裡把幾何形狀硬是抓出來,接著重建出完整的零件。

在寫程式的工作上,它也展現出類似的變通能力。有金融公司的工程師叫它幫交易平台寫一套接收市場資料的模組,Opus 5 寫完後,發現手邊沒有即時的市場報價可以拿來驗證。它沒有停下來發呆或等你下指令,而是自己動手寫了一個測試框架,灌入模擬數據,跑完測試來確認自己剛寫好的程式碼運作正常。

像這樣「自己找方法」並自己反覆驗證結果,之前大概只有 Fable 5 辦得到。但現在 Opus 也辦得到,而且收費只有 Fable 5 的一半,輸出一百萬個 Token 的定價只要 25 美元。

各大AI廠商非常認真要做好模型的分流,在旗艦模型之外,也努力提升替代模型的能力同時也要降低成本!在 Fable 5、Sonnet 5、Opus 5 依序推出後,目前 Claude 家族只剩下 Haiku 還沒進化了。


Gemini Notebook

Google 最近把 NotebookLM 改名成 Gemini Notebook 。這項工具從 2023 年以「Project Tailwind」亮相,已經有超過 3,000 萬人在用。這次改版不只是換名字,還在背後裝上了以 Antigravity為基礎的「安全雲端電腦」。

如果上傳一疊數據報表,Gemini Notebook 會直接在背景「寫出程式碼」並且執行,把複雜的數據算完。使用者不需要寫任何一行程式,它就能直接讀取來源文件完成分析。不過要提醒,你不會真的看到 Antigravity,也不會有一個程式生成的選項,一切都是在 NotebookLM Gemini Notebook 背景運作,由模型自行判斷是否要用執行程式來處理任務。

Google 也預告,未來在 Google 搜尋中的「AI 模式」裡也會導入Gemini Notebook。到時候找資料,可以直接調出自己做過的筆記對照,把搜尋跟研究變成同一個動作。這項功能,先開放給 Google AI Ultra 以及特定企業客戶,未來幾週內會陸續推送到所有 Pro 用戶的網頁版上。


官方介紹

Google 在 AI 模型的發展上,看起來是採取跟競爭對手們不同的策略。雖然旗艦模型持續難產,但 Google 新推出的 Flash 模型家族,宣告 AI 正式邁入「多模型協同、精準分工」的時代。透過讓不同特性的模型各司其職,能在大幅提升自動化效率的同時,壓低 Token 算力成本。

Gemini 3.6 Flash 扮演「指揮官」,具備接近 Pro 等級的推理解析與寫碼能力。它能精準減少試錯與除錯迴圈,Agent 運作時的輸出 Token 比上一代減少 17%,適合統籌複雜的跨步驟流程。

Gemini 3.5 Flash-Lite 則是「執行者」,速度最快、成本最低。其呼叫費用僅約標準 Flash 的五分之一,每秒可輸出 350 個 Token。適合做為子代理,協助主力模型批次處理海量合約解析、商品分類與資料擷取等高吞吐量任務。

Gemini 3.5 Flash Cyber 為「資安專家」,專精於底層漏洞挖掘與修補。能在數小時內翻出系統深層的高危漏洞並直接生成修補程式碼,不過目前這個模型只有提供給政府與特定合作夥伴使用。

小編為大家總結就是,3.6 負責規劃、Lite 負責執行、Cyber 負責防守,而大家最期待的Gemini 3.5 Pro(?)就要再等等啦!


官方教學

這次要來介紹OpenAI的 「AI 寵物」功能。過去把一大疊資料丟給 AI 處理時,你只能把視窗塞在大小有限的螢幕旁,或是時不時切窗盯進度。現在,只要使用電腦版Codex,你的寵物就能自動提醒你任務進度!

當你繼續執行手邊的任務時,這隻寵物會待在螢幕角落,透過頭頂的氣泡回報後台的 AI 正在做什麼。如果 AI 正在運算,寵物會顯示「執行中」;萬一中途遇到錯誤,或是需要你批准才能繼續下一步,氣泡就會立刻變更狀態。看到提示後,滑鼠點擊一下寵物,原本隱藏的對話視窗就會馬上彈出來讓你接手。

如果你不喜歡內建的寵物款式,也能用文字把腦中的想像寫出來,AI 就會直接幫你孵化出一隻全新的專屬寵物。做出來的寵物還能分享給別人,從設定介面抓取專屬連結傳給朋友,對方點開就能直接在自己的 ChatGPT 裡領養同一隻寵物。小編也用了旗刊的吉祥物做實測,真的超級可愛!


官方介紹

Black Forest Labs 最新釋出的模型 FLUX 3,把影像生成的戰場拉到了「物理法則」與「因果關係」上。FLUX 3 把影像、影片和聲音放在同一個架構裡學習的「世界模型」。它不再是單純把三種功能縫合,而是讓 AI 理解現實世界是怎麼運作的。

這代表什麼?當你需要一段「玻璃杯從掉落」的影片時,FLUX 3 不會只一個杯子往下掉的動畫。它會根據重力與慣性,預測杯子撞擊地面的碎裂方式,並且在玻璃碎片飛濺的一瞬間,配上碎裂聲。影像裡的動作與聲音互相約束,門被推開會自然晃動,角色跨場景走動時臉部也不會變形。不再需要再為了搭配AI生成的影像,在音效庫埋頭苦翻,只要丟入場景設定,半天內就能和模型來回修改出十幾個帶聲音的廣告分鏡片。

除了能生成影音,FLUX 3 懂物理的特性,也成為了機器人的眼睛。Black Forest Labs 目前已經與 mimic robotics 合作,將模型搬進 Audi 的工廠裡。在堆滿零件的廠房中,裝載 FLUX 3 的機械手臂不需要人類逐一寫程式教導,就能透過鏡頭「看懂」環境。預測電纜或密封件這類軟性材質掉落的軌跡,並判斷下一個動作該如何抓取、組裝,直接完成生產線上的搬運任務。小編覺得,當機器人開始看懂物理法則,也意味著未來的自動化不再局限於固定指令,機器人不再只能執行單一任務。


Hugging Face

Kimi K3是一款由Moonshot AI(月之暗面)最近在 Hugging Face 開源釋出的模型,在發表當天就在 Frontend Code Arena 盲測從第 18 名跳到第 1,並在七個設計相關子項裡贏下六項。擁有 2.8 兆參數規模,能一次分析多達 100 萬個 Token 的長篇專案與文件。

市場分析指出,Kimi K3是目前最強的開放權重模型,在處理學術研究時,它不會空口說白話。如果請它重現某項天體物理研究,它能在兩小時內翻完 20 幾篇論文、找出公式寫錯的地方、自主寫出 3,000 行 Python 程式,並直接做好UI完整,可以切換數據、查看偏差的互動圖表網頁。

更值得討論的是,這款模型的完整權重已經開放下載。企業不用再把敏感的合約或個資送往外網,直接在本地端的伺服器裡就能部署這個大腦,用更低的運算成本,讓 AI 自動跑完原本昂貴的大型程式與研究工作。

這股開源風潮,讓社群熱烈討論,黃仁勳更是積極捍衛開放權重AI。他與微軟執行長及數十家科技公司共同連署發表公開信,呼籲政府不要限制開放權重AI的發展,強調開放權重模型對提升網路安全的重要性。

今天的內容就到這裡啦,提供您對這篇內容的想法,讓我們持續進步!