本週目錄(7 則)
🔥 OpenAI 推出 ChatGPT Work,鎖定無程式背景的白領工作者
🔥 OpenAI 推出新語音模型,能同時聽說、可打斷,對話更流暢自然
🧰 美智庫警告:限制頂尖 AI 模型存取,只是將優勢拱手讓給中國
🧰 主打手機本地端 AI,新創宣稱在 iPhone 上運行最大規模模型
⚙️ GitHub 透過 AI Agentic Workflows,解決跨儲存庫文件同步的痛點
⚙️ NVIDIA教你免微調模型,透過LangChain調整框架提升AI Agent準確度
🗞️ SpaceXAI 推出 Grok 4.5,整合 Cursor 訓練並以低價挑戰對手
🔥 本週頭條
Reuters · 2026-07-09
OpenAI 推出了名為 ChatGPT Work 的新服務,旨在讓沒有程式設計背景的使用者也能利用 AI 製作文件、簡報和網站。此舉直接與 Anthropic 的 Claude Cowork 競爭,顯示 AI 巨頭正激烈爭奪更有利可圖的企業市場。
Q Q kangber 點評
讓不懂程式的人一鍵生成網站聽起來很棒,但真正的問題藏在後頭。當 AI 產出的東西需要微調、除錯,或與其他系統串接時,使用者若看不懂也改不動,就只是把判斷權和掌控權一起外包了。工具越方便,越要問它把日後的維護成本藏到哪裡去。
TechCrunch · 2026-07-08
OpenAI 推出 GPT-Live 系列新語音模型,最大特色是能同時聽與說(full-duplex),讓使用者可以自然地打斷 AI,使對話更流暢。這項技術也為即時翻譯等功能打下基礎,目標是讓語音成為駕馭複雜任務的主要互動介面。
Q Q kangber 點評
即時翻譯的展示反而露了餡,模型能講多種語言,不代表它懂怎麼「好好講話」。口音跟語氣這種「最後一哩路」的細節,才是 AI 從「能用」到「好用」最難跨過的坎。不過,能夠隨時打斷 AI,把對話主導權拿回來,確實是個體驗上的巨大進步。
🧰 模型與工具
R Street Institute · 2026-07-07
美國智庫 R Street Institute 發表分析,批評因恐懼風險而限制頂尖 AI 模型存取的政策是戰略錯誤。報告指出,此舉不僅無法阻止能力擴散,反而會削弱全球對美國技術的信任,並將市場機會讓給中國的開源模型競爭對手。
Q Q kangber 點評
妄想用一把鎖頭鎖住一個概念,本來就是行不通的。模型本身可以被管制,但組成它背後的「能力」與「方法論」是關不住的。與其禁止別人使用最好的那把錘子,不如想辦法讓自己成為最懂怎麼蓋房子的工匠,這才是真正的護城河。
The Information · 2026-07-09
由知名創投 Khosla Ventures 支持的新創公司宣稱,他們達成了在 iPhone 上運行史上最大規模 AI 模型的技術突破。這項發展可能為本地端 AI 應用帶來變革,讓模型能在不需連網、保障隱私的狀況下於個人裝置上執行。
Q Q kangber 點評
跑得動跟跑得好完全是兩回事。我第一個想問的是,為了讓這個「最大」模型擠進 iPhone,它在速度、準確度上犧牲了多少?還有,手機的耗電和發熱問題解決了嗎?如果執行一個任務就要燒掉 20% 電力,那對講求穩定運作的自動化流程來說,實用性就得打上一個大問號。
⚙️ 自動化與 Agent
The GitHub Blog · 2026-07-08
GitHub 內部團隊分享如何使用 Agentic Workflows 工具,讓 AI 自動偵測程式碼變更並草擬對應的說明文件。這套系統能安全地跨越不同程式碼庫運作,並在產生文件草稿後自動指派給原開發者審核,大幅縮短文件更新的延遲。
Q Q kangber 點評
最聰明的設計在於把 AI 和執行權限徹底分開。AI 只能產出「我想做什麼」的指令,無權動手;實際執行的是另一支權限極小的程式。這種沙盒化的架構,才是把 AI 導入工作流的正確姿勢,比起給 AI 一把管理員鑰匙然後祈禱它不出錯,要可靠多了。最後堅持由原開發者審核草稿,等於是把 AI 當成最快手的實習生,而不是直接取代判斷的決策者。
NVIDIA Developer · 2026-07-09
NVIDIA與LangChain聯手提出「Harness Engineering」概念,展示如何在不微調模型的情況下,單純透過修改Agent的系統提示詞與中介軟體(Middleware),就讓開源模型Nemotron 3 Ultra的任務準確度逼近昂貴的頂級專有模型。此方法的核心是建立評估基準,分析錯誤並迭代修正框架,而非改變模型本身。
Q Q kangber 點評
「調整框架,而非模型」這個概念,完美點出了多數人導入AI時的盲點。很多人以為只要選對模型、接上API就結束了,但問題往往出在模型跟工具之間的溝通不良。NVIDIA與LangChain提出的作法,等於是幫模型加裝一位「翻譯兼保母」,在它可能出錯前就先用程式規則介入修正。這種作法雖然比較費工,但把控制權拿回自己手上,遠比把系統穩定性外包給模型的「機率」來得可靠。
🗞️ 華語圈動態
iThome · 2026-07-09
SpaceXAI 發表了新一代大型語言模型 Grok 4.5,是首款與 AI 程式編輯器 Cursor 共同訓練的模型。除了在程式開發能力追趕領先者,Grok 4.5 更主打比對手低廉許多的 API 定價與推論效率,試圖以成本優勢在市場上競爭。
Q Q kangber 點評
真正的重點在 API 定價。輸出百萬 token 從對手的 25-30 美金降到 6 美金,這個價差會讓許多卡在成本的自動化應用,例如自動生成完整報告或輔助開發,突然變得可行。但我也會觀望,這麼低的價格和號稱的高效率,是不是犧牲了某些穩定性或在特定情境下的精確度換來的。
✍️ 本週結語
上週四我去參加 Google Cloud Day,他們展示的多模態模型真的超猛,但 Gemini 再不掏出王炸作品正式版,真的會被大家遺棄啦!
— Q kangber
這期給幾分?點一下告訴我
點一下就完成評分,不用一秒