ai-video
AI 影片一長就穿幫:Google 替它找來一整組劇組
AI 影片為什麼一長就穿幫?主流模型一次只能生成十幾秒,長片得一段段接,接著接著角色換了衣服、道具變了樣。Google Research 9 月 24 日公開四個框架,讓一組 AI 代理人分別當導演、場記、攝影和品管,做出將近十分鐘不走樣的短片。這篇拆解分工、成績,以及它們還沒真正合體的事實。
ai-industry
「不會幻覺」的 Jev 是什麼?7 張圖拆開 TypeSafe 的話術
Jev 是什麼?TypeSafe AI 在 2026 年 9 月發布的 System One Model,不生成文字,只回傳選項、分數和機率,每百萬 input token 0.042 美元、延遲 70 到 500 毫秒。這篇用 7 張圖整理它的 API、官方 benchmark 該怎麼讀、「不會幻覺」這句話少講了哪一格,以及中文團隊決定要不要用之前該問的四個問題。
Featured
吳恩達挖 1 萬筆職缺:AI 工程技能沒有 prompt engineering
AI 工程技能該練哪些?吳恩達分析 1 萬多筆職缺與數十場招募訪談,歸納出四項:建構與部署 AI 應用、軟體工程基本功、使用 coding agent、塑造開發方向。裡面沒有 prompt engineering。這篇拆解四項各要求什麼、他八月新補的六個子技能,以及 LinkedIn 上最尖銳的那則反駁。
資深工程師用 AI 反而慢 19%:coding agent 該放手的六個時機
coding agent 怎麼用才不浪費時間跟 token?關鍵不是提示詞,是六個判斷點:這任務該不該交出去、spec 寫多細、context 給多少、規劃與執行怎麼配、什麼時候加驗證器、什麼時候拆多 agent。每個判斷點都有可操作的判準。
第一堂不准你寫評分標準:AI 功能怎麼測、evals 怎麼做
LLM evals 怎麼開始做?教過 4,500 個工程師的做法是:先別寫評分標準,先人工讀 20 到 50 筆真實失敗,標成二元對錯,再從那些失敗長出評分器。這篇拆解完整閉環:三種評分方式怎麼選、LLM 當裁判會怎麼騙你、以及什麼時候該停手。
主題
所有主題Latest
看全部 →74% 的 AI 程式碼要返工:你的 spec 少寫了什麼
AI 程式碼上線後要大改,原因幾乎都不是模型不夠強,是 context 不足與系統假設有誤。當 agent 能把清楚的規格直接變成軟體,工程師的價值就移到「決定規格裡放什麼」。這篇拆 spec 該寫到多細、真正該寫進去的是什麼,以及這對你的履歷代表什麼。
45% 的 AI 程式碼帶漏洞:五個該打開 diff 就看的地方
AI 生成的程式碼看起來很乾淨,問題不在語法在架構。Veracode 測 100 多個模型的結論是 45% 帶 OWASP Top 10 漏洞,兩年沒改善。這篇給五個可執行的審查點:資料存取、錯誤處理、狀態放哪、權限邊界、單位成本,以及怎麼把它們變成 agent 看得懂的約束。
多數開發者不該買 DGX:先問你缺的是容量,還是頻寬
DGX Spark、Station、GB300 不是同一張購物清單。多數獨立開發者停在工作站顯卡就夠;只有資料不能上雲、又要塞 70B 以上,Spark 才開始合理。先問缺的是容量還是頻寬。
Station 進 Windows:NVIDIA 第一次把 DGX 放到 Fortune 500 書桌上
2026 年 6 月 1 日 GTC 台北,NVIDIA 宣布 DGX Station for Windows,預計第四季由 ASUS、Dell、GIGABYTE、HP、MSI、Supermicro 出貨。重點不是又加記憶體,是 DGX 第一次走進 Fortune 500 每天在用的 Windows。
748GB 拆開之後:Station 不是縮小版 GB300
DGX Station 行銷頁寫 748GB 統一記憶體,官方規格表卻拆成 252GB HBM3e 加 496GB LPDDR5X。對照機櫃 GB300 的 288GB/8TB/s,說明桌邊版跟機櫃版共用品牌,不共用完整晶片。
78k stars 是品質還是時機?拆解 Paperclip 的爆紅方程式
5 個月、78k stars、14.3k forks——Paperclip 的成長是產品真的好,還是站在 OpenClaw 的肩膀上?拆解爆紅的組成:真空時機、口號記憶點、遷徙潮,以及「Stars 不是品質指標,是時機指標」背後的證據。
Claude 浮水印是什麼?讀者看不見、歐盟看得到
Claude 浮水印是 Anthropic 依歐盟 AI 法在文字生成時埋入的統計標記,用的是 Google DeepMind 的 SynthID-Text。本文說明它怎麼運作、偵測不到什麼、跟 Pangram 差在哪,以及對寫作、程式碼、翻譯的實際影響。
DarwinX 是什麼?不改模型,先改 agent 外殼
DarwinX 是什麼?Salesforce 一篇論文主張:模型權重可以完全不動,只改提示詞、工具、技能包和流程,coding agent 分數就能往上走。這篇用白話拆它怎麼篩版本、數字哪裡能信、台灣開發者現在能偷師什麼。
128GB 為什麼跑輸 RTX 5090:Spark 買到的是容量,不是頻寬
DGX Spark 官方有 128GB 統一記憶體,頻寬卻只有 273GB/s。這篇對照官方規格,說明為什麼「塞得下 200B」跟「跑得過消費卡」不是同一件事,以及什麼工作流才該買容量。