冷開場——封面。先別自我介紹。讓問題靜五秒,再說:「整場只問這一句。」右邊目錄是房間唯一的議程;不要照念。
圖說——大報封面。粗線壓細線、中間跑日期那組,是這套設計唯一印「線」的地方;其餘靠留白。標題是青/洋紅/黃三版微微套不準,像油墨在新聞紙上,不是螢幕字。右欄五幕小板號是索引;不要讀出來。
冷開場 · 五個印記
冷開場——封面。先別自我介紹。讓問題靜五秒,再說:「整場只問這一句。」右邊目錄是房間唯一的議程;不要照念。
圖說——大報封面。粗線壓細線、中間跑日期那組,是這套設計唯一印「線」的地方;其餘靠留白。標題是青/洋紅/黃三版微微套不準,像油墨在新聞紙上,不是螢幕字。右欄五幕小板號是索引;不要讀出來。
五個印記、同一種油墨、同一個方框——第一個和最後一個是同一塊網點屏。重點是:下一小時裡,世界沒變,變的是你看得見什麼。不要逐個解釋;讓房間自己讀。有人問才說:第二個是對半上墨的圓盤;第四個是第四幕那四個站。
圖說——五格同框。I 霧:只有網點、沒有圖。II 鏡:對半墨、軸在青。III 海:長短不齊的細線+一點。IV 航程:一線四站。V 歸來:又是 I,外加邊界與中心一點。頭尾同屏——世界沒變,邊界是新的,而你在裡面。
模型之外的世界
幕開場。說:這一幕是整場裡唯一講「外面世界」、不講機器本身的一段。為的是:別讓人把 AI 當成軟體新聞。
這塊板留著。請房間指出:今年親身感覺到的那一股力量。不要八條都講——出口三條就夠,其餘交給板。
圖說——八張剪報釘成板,每張底下一行「這股力是什麼」。這是證據,不是口號;房間應能認出至少兩個來源。後面會原板再回來,只改說明。
四條帶日期的事實——是報道,不是感覺。多停「下架」那一列:你建在上面的模型,可以在公告日被抽走;通知期就是你全部的預警。來源寫在備註:agent 編程報導、記憶體市場、Anthropic 下架頁(Sonnet 4/Opus 4 等)。
圖說——四列堆疊:左數字、中主張、右來源。2026 年 6 月那列用強調色——它是「可被撤回的地基」。
先講故事,再亮投影。Foxconn,H. L. Cheung(前 Apple 總部)對我們說:「要把大象綁在樹上。」拆給房間聽:大象就是我們會點名的那些大師。三十年長出來的思想,不能像牽小狗一樣牽進一句 prompt。所以你不搬大象——你把它綁在不會動的東西上:AI。再說論點:真正可上岸的,是能說出「這跟 AI 有關,因為……」的那一綁。綁不上的,放回岸上,第三幕的海牆還認它。
圖說——左:樹幹 AI,三個項圈。右:三團重(不是動物插圖),各有名字與年代。繩子垂著接到樹幹;底下一團沒項圈、虛線繩——沒綁上的,就是舊「關卡」現在住的地方。指繩,別指盒子。
從裡面看的十個機制
第二幕是整場的心臟。十個機制。每個都是圖,不是口號——學生應能默畫。先警告:這一幕之後,「AI 懂了」會變成一句他們很難說出口的話。
先讓房間數 strawberry 裡有幾個 r,再揭開切法。模型從頭到尾沒拿到字母。設計後果:每句 prompt 進模型前,已被別人的字母表重切過。來源:BPE 類 subword。
圖說——左右兩套「字母」。左:十個字母格,三個 r 強調,底下寫 3——你以為交出去的。右:三塊 token(str · aw · berry),底下問號——模型真正拿到的。字母鎖在塊裡,從不單獨被數。
能白板就畫平行四邊形。關鍵句:這是模型內部座標上的真向量運算,不是比喻。然後講邊界——精選例子很乾淨,推遠就糊。縫在於:模型有概念方向;你有親身遭遇。
圖說——百分比座標上的平行四邊形:man/king/woman/queen,兩支位移箭頭同向。右邊三張卡才是後果,不是裝飾。
指照片。你話沒說完就看見狗。模型拿到的是編號磚格+位置標籤,像讀句子一樣推。所以影像模型對左右、前後、幾個,會自信地錯。
圖說——真照片上 14×14 細線格,旁是模型視角:編號磚,每塊向量+位置。格子就是論點。
第二幕裡少數「人還在領先」的一頁。2025:不只找到特徵,還能追特徵觸發特徵的鏈。Golden Gate 示範:把一個特徵推到離譜,模型會執念,一度自稱是橋。同一手法現在用來查發布前有沒有「會騙人」的內部特徵。
圖說——上:找到→追電路→出貨前使用。中:正常 vs 十倍激發。右:該特徵對應的照片概念。
人被爐子燙一次就懂「熱」。模型繼承的是描述,不是遭遇——符號接地問題。世界模型研究(JEPA 類)想補這縫,研究者也坦白:單靠它不夠。要避開的設計錯:把自信的語言當成核實過的經驗。
圖說——兩欄。左:一張照片+數字 1(一次接觸)。右:四行訓練文字+數字 0(從未接觸)。兩個數字的不對稱就是機制。
經典熊貓→長臂猿。噪聲鑽的是模型過度依賴的窄模式:你眼看不見,對模型卻是決勝。硬後果——若人看不出的輸入能讓系統自信上當,單靠模型自信不是證據。prompt injection/jailbreak 同一不對稱。
圖說——照片+計算噪聲=第二張照片。底下自信條 57.7% 與 99.3%。讀兩條,別讀字:它愈錯愈自信。
模型對這場對話「知道」的一切,都活在 context window;會話結束就沒有。窗內像有記憶——全記得、即時。下一場:昨天像沒發生過。所以 agent 設計要外掛記憶,而不是信模型會記得。狀態設計修的是結構上限,不是錦上添花。
圖說——兩個 context 窗。左:填滿的條。右:同樣六格全空。中間箭頭只寫:會話結束。不是刪除——本來就無處可存。
每個訓練例子都有「下一個正確詞」;棄權幾乎從不獲獎。所以在灰區,完成句子的習慣會贏。這不是隨機故障——正是讓它多數時候流暢又正確的同一機制。真修法是證據檢查、棄權門檻、人閘,不是叫它「小心一點」。
圖說——三條獎賞棒:流暢且對(滿)、流暢且錯(大半)、「我不知道」(幾乎沒有)。二、三之間的縫就是幻覺機制。右欄才是真修法。
青少年的價值來自多年家庭、摩擦與後果。模型的來自兩層工程:評分者偏好,以及某些實驗室寫下的 constitution(會引用如世界人權宣言)。判斷沒有消失——它移到上游。所以「AI 同意我」說的是評分者與文件,不是活過的倫理經驗。
圖說——十八年對兩層。左:家庭/摩擦/後果/自己。右:RLHF 與 written constitution 兩盒。視覺不對稱就是論點。
慢慢收第二幕。讀清單。然後說:那條縫不是要補的 bug——它正是判斷、記憶與親身責任仍屬昂貴的人側的原因。中文那句現在是被證據賺來的,不是空喊。
圖說——無圖。全幅句子頁。十張圖之後最安靜的一頁。慢讀,讀完停嘴。
十五位建造者 · 四個架構 · 衝突
第三幕開場。十五位真思想家,收在四個架構下。每張臉仍有具名一站;架構是記住他們的方法。這裡要慢——先允許房間愛上誰,再聽其餘。治理句說一次就停:這裡不封殺任何人,也不藏任何事。這一頁不要預告缺點。
說: 十五位建造者,收在四個架構底下。你會先愛上其中幾個,然後才聽見其餘——這就是重點。
不要: 在這裡預告 Torvalds 2018、DHH 2021,或 Dijkstra 刻薄的那一面。
節奏: 慢。讓房間先進入「海」。
在叫任何名字之前先舉這塊板。海故意留寬——這裡不封殺。決定標準不是我的口味:是兩份公開文件,要比這門課更老、更大。指著網,把文件念出來:UNESCO AI 素養框架,以及 2021 年 11 月 193 國鼓掌通過的倫理建議。再指:什麼擱在網上、什麼穿過網。
圖說——網真的畫成網。上:海仍是淡網點。中:全幅交叉帶,標兩份真文件。網上擱著有日期的團塊;穿過的另有去處。
先只讀上排。讓他們真的愛上那四個想法——出聲、不打折、不「但是」。愛是機制:只有愛過的想法才改得了你的形狀。再讀洋紅線,之後什麼都別說。不要救任何人,包括你自己。下排最後才平讀。兩件不要:解釋圖;放一個你自己都愛不起來的人在這裡。
圖說——四條鍵往下:全強度墨被洋紅線切開,下半變細到小方塊。沒有歸零——殘餘才是重點。愛上與失戀從不對稱。
要做: 上排盡情愛。洋紅線。靜默。下排平讀。
不要: 解釋圖。不要用溫吞例子自保。
若有人問: 一個想法的真,跟作者的人品,是兩條獨立的線。
公開框架:UNESCO 學生/教師 AI 素養(2024),以及你們學校已寫的政策。先尊重這些——終章是加乘,從不替代校本框架。最後一句出聲:評核規則是他們的,不是我們能軟化的。
圖說——左:框架作地線,三柱(人優先、過程重於產出、按年齡分階),終章是青虛線板承在同柱上——補,不替。
2021 年 11 月,193 國鼓掌通過。人權與尊嚴是基石——其餘價值都壓在上面。注意環境條款:成本、能源、水在這裡是倫理問題,不是註腳,直接接回霧板。
圖說——文件畫成砌體:三價值作柱,全落在一條實心橫梁。梁下基石:人權與尊嚴。通過事實降到邊緣。
不要定義三堆。一次丟一個想法,讓房間聽見配句。第一堆,深偽同學的聲音:這不是辯論,是石頭——我點名、當眾放下,讓他們知道石頭長什麼樣。第二堆賺信任——Dijkstra 完整形式驗證論證是真的、是偉大論證,但不是今年這個房間。退回句在這裡用。第三堆才是上岸。
圖說——三堆,各由一個真名字承載:粗塊/開環/實心強調方。底下判句是出聲那句。
一條軸,兩個真實決定落在相反位置。先左端(我權威最小、他們最大):這次用 Rust 還是 C——跟我辯、帶證據,我會當眾改計劃;小端軸唯一的玩法。再走到右端:有人想把同學作文餵模型批改。那不是我能定的,也不是「開明」能改的。
圖說——軸兩側對頂楔形。利害升高,否決權威變厚;利害降低,房間挑戰權變厚。兩枚虛線針落在相反處。
兩個想法、一次檢查,房間看著關卡怎麼「不及格」。先上排:Kapur 有產出的失敗拿滿六印——連無聊的也要當眾勾。再下排:用模型互評同學作文,三印乾淨,死在第四。不是三分之六。是整張退。
圖說——關卡畫成蓋章檢查,不是量表。上排六印全亮;下排第四枚打叉,其餘虛線空印。
當眾把一個真案例走完量尺,系統才不是理論。判決:分拆上岸。linked-list 品味課上岸可教;mailing list 言行只點名、不示範,2018 道歉算誠實紀錄的一部分。
圖說——左四量尺走完,右判決:兩個標記,不是一個。可教/只點名。形狀本身值得拍照。
教這句原句。當真實、正確、卻不適合這年紀或這房間的想法冒出來時,用它,不要用「禁」或「錯」。教的是釋放,不是否認——想法還在、有名、以後可再撿。
圖說——句子頁,底下三粒:不禁、不錯、帶著名字放走。原句教。
幾乎別說。讀左欄,再讀右欄,讓房間發現是同一四樣。沒人設計兩次——課室與機房都會:吞下信不過的東西、對白紙、分類、留給太貴的本地決策一條升級路。最後一列值得停:升級政策最無聊,也最貴。
圖說——兩欄四列,細線連,無箭頭、無編號、不標「模式」——相同幾何就是全部論點。
幾乎什麼都別說。 左欄,右欄。停在最後一列:升級/誰做最後決定。
內部教學名冊——面孔出處在 Sources。這是名冊,不是課綱。十五個具名停站,嵌在四架構:迴路、表徵、氣質、堆疊。不是明星點名。當系統學:名字淡了,機制還能用。指板:四列、十五臉、底下那一問。然後進架構 A。
架構開場。原則讀一次。點名承載者。先別教大師。
讀一次: 被收住、被對照過的錯,勝過只聽正確答案。
點名承載者: Kapur、Pocock、Karpathy、Gagné。
先別教他們。
Manu Kapur,ETH/前 NIE。兩段式 Productive Failure——順序是機制;對照是課。誠實邊界:STEM、中學以上;沒有第二段就脆。接到 AI——別停在梯度下降:訓練失敗有用;上線失敗很靜(沒梯度、沒記憶);系統失敗有設計 vs 沒設計。學生還有回饋環;模型沒有。有空各一句:Transformer、Anthropic、DeepSeek 作為「有名字的失敗發明」。
機制: 第一段先試(會錯)→ 第二段 canonical + 明確對照。順序就是設計。
誠實邊界: 偏 STEM/中學以上;跳過第二段就脆。
接到 AI(一定要打中):
不要停在: 「梯度下降就是 productive failure。」那是淺映射。
有時間才補: Transformer / Anthropic / DeepSeek——各一句「有名字的失敗發明」,不是歷史課。
學生一句: 「那我應該永遠先掙扎?」→ 只有當遷移重要、且失敗安全時。不安全的掙扎不是 Kapur。
Grill-Me:一次一問+建議答案,直到樹關起。背景 30 秒:聲樂教練→XState→TypeScript→綜合。模型被訓去填縫不是發問——Grill-Me 是硬覆蓋。連下一板:在學生無法單獨「有產出地失敗」的領域,Pocock 就是 Kapur。
機制: 一次一問 + 建議答案 → 接受/修改/否決,直到樹關起來 → 再動手。
背景 30 秒: 聲樂教練 → XState → TypeScript → 綜合。他練的是:聽見「嘴上說的」和「真正要的」之間的縫。
誠實邊界: 有摩擦;他自己後來也收窄了 Grill-Me。
接到 AI: 模型被訓練去填空,不是發問。Grill-Me 是硬覆蓋。
學生一句: 「我 prompt 得更好不行嗎?」→ Prompt 有用;利害一高,關起來的樹更有用。
用力打。不要趕。不要跳。
整門課的結構黃金。
| | Kapur | Pocock |
|---|---|---|
| 誰產生錯 | 學生 | 老師/追問者 |
| 領域 | 有界(STEM) | 開放(需求) |
| 第一段 | 自己生出的錯答 | 製造出來給你評的建議 |
說:
同一原則,兩種落地。 AI 當 Grill-Me:模型生出「聽起來對」的錯;你改正;對照就是 spec。 沒有 Kapur,Grill-Me 只是把戲。沒有 Pocock,Kapur 只是課室技巧。
不要趕。時間緊也別先砍這板。 先砍 trivia。
1.0/2.0/3.0 與會漏的抽象。庫的奇蹟前那個小迴路是疤,不是可愛方法——別變傳記。橋:活證架構是在壓力下賺來的。全信只在備註/Bonus,除非 dessert 才讀。
機制: Software 1.0/2.0/3.0;會漏的抽象;庫的奇蹟之前,先有那個小迴路。
人味(房間撐得住才說): 小迴路是疤,不是可愛方法。Tesla 的壓力,後來他選擇教書。
不要: 變成明星傳記。
不要: 朗讀整封「信」——那留在備註/Bonus。
橋: 他證明這些架構是在壓力下賺來的——不是為了湊「教學名冊第三位」。
天賦→催化→才幹。Benchmark=天賦,產品=才幹。各一口氣:GPT-4 的 RLHF 月數、Claude constitution、DeepSeek-R1 pure RL。下一張承認板——別跳。
機制: 天賦 → 催化 → 才幹。沒有自動。Benchmark = 天賦;產品 = 才幹。
AI 例子各一口氣: GPT-4 的 RLHF 月數;Claude 的 constitution;DeepSeek-R1 的 pure RL。同一檔天賦,不同催化。
誠實邊界: 情意天賦很難操作化——所以我們不做單一 IQ 關卡。
由主持親口說。不要改寫成安慰。
大致這樣說:
我給你的是火花。把天賦變成才幹的催化,發生在你離開這房間之後。練習、回饋、時間、社群——Gagné 的模型需要這些。一堂課可以啟動。它不能代替。
不要: 軟成雞湯。不要: 為這門課道歉。要: 承擔邊界。你在示範對工具誠實——包括這一堂。
架構開場。原則讀一次。點名承載者。先別教大師。
原則: 先設計資訊的形狀;行為才有地方站。
A+DS=Programs。聊天紀錄 vs 設計過的記錄。引向金句板。誠實邊界:Pascal 在系統層輸給 C——純粹有帳單。規模上的結構:tensor/embedding/attention 仍是表徵紀律。
機制: Algorithms + Data Structures = Programs。聊天紀錄 vs 設計過的記錄 {goal, step, results, risks}。
誠實邊界: Pascal 在系統層輸給 C——純粹有帳單。
接到 AI: Agent 會飄,因為它每回合用散文重新猜狀態。
留在螢幕。靜默。不要在上面解釋。
要修的不是更好的 prompt。 是更好的表徵。
靜默。心裡數到五。 需要才補一句:「lost-in-the-middle,常常是表徵失敗穿了模型的衣服。」
linked-list 好品味:改表徵,特例消失。分拆上岸已在治理——2018 只一句。有 45 秒:模型跑在 Linux+Git 上。Prompt 打補丁=壞 list;狀態槽=pointer-to-pointer。
機制: 好品味 = 改表徵,讓特例消失(linked list)。
分拆上岸已在治理練過——2018 一句帶過:品味 ≠ 善良。
隱形地基(有 45 秒才說): 每次 model run 都坐在 Linux + Git 上。他沒做模型;模型跑在他的工作上。
接到 AI: 用 prompt 打補丁 = 壞 linked list。狀態槽 = pointer-to-pointer。
1959 咖啡館六十秒:沒筆,二十分鐘,最短路徑;成名令他意外。不變量+局部步驟。Agent 亂跳工具=goto。先想再 prompt。對 BASIC 的刻薄有名——嚴謹≠善意,分拆上岸。
故事 60 秒: 1959 年咖啡館,沒筆沒紙,二十分鐘——最短路徑。成名令他意外;他繼續寫 EWD。
機制: 不變量 + 局部步驟;程式不用跑也能讀。
接到 AI: Agent 亂跳工具 = 新衣服的 goto。咖啡館方法:先想再 prompt。
誠實邊界: 對 BASIC 學生的刻薄有名字——嚴謹和善意可分開。分拆上岸。
完整 97/3——流行 truncated 版講反了。Prompt 常 97%;架構 3%。2023 自信胡說→2025 公開改口。改正是練習。評測識字:自己設計量法。
完整意思: 過早優化……但那關鍵的 3%。流行的 truncated 版把他講反了。
接到 AI: Prompt 常是 97%;狀態、schema、硬停止 ≈ 3%。
人味: 2023 自信胡說 → 2025 公開改口。改正是一種練習。
學生一句: 「所以永遠不要優化 prompt?」→ 量過再優化;別活在 prompt 角色扮演裡。
Simple≠easy。Token 太多讓架構隱形。Prompt 前三問:關心什麼、誰擁有、什麼絕不能發生。然後才生成。Token 便宜,混亂很貴。
機制: Simple(結構上一折)≠ easy(離你近、主觀)。Complect = 編在一起。
AI 年代: Token 太多,架構反而看不見——比硬體太豐還糟。
帶走: Prompt 之前——(1) 關心什麼 (2) 誰擁有什麼 (3) 什麼絕不能發生。然後才生成。
學生一句: 「生成不是免費嗎?」→ Token 便宜,混亂很貴。
架構開場。原則讀一次。點名承載者。先別教大師。
你優化什麼,就會變成文化。
最少「我的」意外——學好 Ruby 之後——不是宇宙通用最少意外。履歷 vs 流暢的關心。鋪五聲音+開心那問。
大家常漏的修正: 最少 我的 意外——在你學好 Ruby 之後——不是宇宙通用的最少意外。
MINASWAN: 氣質變成規範。
接到 AI 的鋪墊: 三十年的選擇,對上一句流暢的「我想幫你」。
走一輪。再 Matz 那問。先別辯。這五位是外來聲音,不在十五人內——當代對 AI 社會效應的批評,用來墊 Matz。有人問就說:沒編號站、沒肖像,故意的。Turkle(模擬親密)、Newport(方便與能力)、Harris(注意力經濟)、Mitchell(RLHF 與討好)、Mollick(升級 vs 去技能)。
走一輪,先別辯論: Turkle · Newport · Harris · Mitchell · Mollick
然後 Matz 那問:
模型讓你開心。你得先變成什麼,才配得上那份開心?
若答案是「什麼都不用」: 「那不是功能。那是警告。」
不要 開成心理輔導圈。一拍。走。
預設就是產品倫理。幽靈設定是會出貨的政策。Rails 退了;哲學轉世在 agent 框架。2021 禁令點名不示範。
機制: Convention over configuration;預設 = 政策;幽靈設定會出貨。
轉世一句: Rails 退潮了;哲學活在每個 agent 框架裡。
誠實邊界: 2021 演講禁令/離開——點名,不示範。架構課 ≠ 職場法令。
學生一句: 「所以預設都是邪惡?」→ 預設很有力。問是誰選的、為了什麼。
架構開場。原則讀一次。點名承載者。先別教大師。
模型之上拒絕。模型之下信任。模型旁邊監督。
Zen 兩句。直譯器拒絕;模型猜測。沒人引用他;人人實作他。Ritchie 後接三明治板。
Zen 兩句: 特例不夠特殊……/面對歧義,拒絕猜測。
接到 AI: 直譯器會停;模型會續。幻覺是這設計差在規模上的樣子。
一句: 沒人引用他。人人在實作他(schema、硬停止、CAI 誠實)。
設計上徹底信任;帳單來了(記憶體漏洞、NSA/CISA)。llama.cpp 熱路徑仍選小 C。模型也許最安全;地基不是。然後三明治板。
設計: 徹底信任——不檢查邊界,是選擇。
帳單: 約 70% 記憶體漏洞;Heartbleed;NSA/CISA 2025。
接到 AI: llama.cpp/熱路徑仍選小 C。模型也許是最安全那層;底下的 C 不是。
不要 羞恥喜歡系統的學生——教帳單。
畫三明治。Rust=編譯期拒絕;Armstrong=執行期復原。
上 Guido schema/硬停止/棄權 中 Model 上面被約束,下面跑在信任上 下 Ritchie CUDA/驅動/C
說: 沒人引用他們。人人在實作他們。他們是水。 然後:Rust = 編譯期拒絕;Armstrong = 執行期復原。
電梯火花 20 秒。Borrow checker。開放問題:agent 團隊的 borrow checker 查什麼——吊著。
電梯火花 20 秒。Borrow checker:多讀 XOR 一寫。
開放問題: agent 團隊的 borrow checker 會查什麼?吊著走。
問題從來不是 crash——是沒人注意。小 crash、隔離、乾淨重啟。Let it crash≠不處理錯誤;快樂路徑與復原分開。
金句: 問題不是 crash——是沒人注意到、也沒人做什麼。
給 agent 三條: 小 crash · 隔離 · 乾淨重啟。
不要: 「let it crash」=「不用處理錯誤」。快樂路徑和復原路徑要分開。
四個架構是記憶結構。然後衝突圖。
四個盒子。一問:
這其實是誰的判斷——哪個架構正在吃力?
指四個名字。不要重念十五人。
不要假裝和諧。每次練習:(1) 點名具體 AI 系統 (2) 選一軸 (3) 手指按一極——不站中間 (4) 說哪個架構在吃力——迴路、表徵、氣質或堆疊。04–06 極來自 vault:猜 vs 拒、prompt vs 表徵、掙來的快樂 vs 被給予的舒適。
說: 不要假裝和諧。這些人並不同意。
每次都做的練習:
流暢不是正確。同一週、不同層,兩極都可以對——規劃求容易,不可逆工具閘在正確。陷阱:答得快所以一定對。代價真實時,右極屬架構 B。
圖說——軸的概念圖(tension-01)。
關鍵: 流暢 ≠ 正確。同一個人同一週可以在不同層各站一極。
陷阱: 「模型答得快,所以一定對。」
金屬→控制(Ritchie、Torvalds、CUDA)。編排→安全(Rust、Armstrong)。陷阱:把飛快 kernel 文化套到 agent 共享記憶。架構 D 就是這軸的三明治。先指層再選極。
圖說——軸的概念圖(tension-02)。
關鍵: 金屬層 → 控制。編排層 → 安全。
陷阱: 把飛快的 CUDA 文化套到 agent 共享記憶上。
99.9% 帶永不失敗味;0.1% 仍要斷路器。Kapur 的失敗在人(課)。Armstrong 的失敗在系統(事故設計)。同詞,兩架構。實驗室衝高;出貨仍要收容。
圖說——軸的概念圖(tension-03)。
關鍵: Kapur 的失敗 = 課(人)。Armstrong 的失敗 = 事故設計(系統)。
陷阱: 「99.9% 準」卻沒有 0.1% 的斷路器。
時間緊優先。左:模型本性——補完並繼續。右:Guido+Grill-Me+schema+硬停止。練習:說一個你人生裡的 tool call——猜還是停?一句:沒人引用 Guido,人人實作他。Jailbreak=猜極打拒極。
圖說——軸的概念圖(tension-04)。
左: 模型本性——補完並繼續。
右: Guido + Grill-Me + schema + 硬停止。
練習: 「說一個你人生裡的 tool call。猜,還是停?」
一句: Jailbreak = 猜極在攻擊拒極。
時間緊優先。左:再加一句(97%)。右:更好狀態/結構(3%)。練習:失敗的 agent——下一步句子還是槽?回聲 Wirth 金句板。把 transcript 當記憶,是表徵失敗穿了 prompt 的衣服。這軸屬架構 B。
圖說——軸的概念圖(tension-05)。
左: 再加一句(97%)。
右: 更好的狀態/結構(3%)。
練習: 失敗的 agent——下一步是句子還是槽位?
回聲金句板 39。
時間緊優先。Matz 掙來的手藝之樂 vs LLM 給予的舒適。停在:你得先變成什麼,才配得上那份開心?不要救場。靜默就說:把問題拿著,不必出聲。不要說教成癮;邀請判斷。架構 C。
圖說——軸的概念圖(tension-06)。
停在 Matz 那問。不要救場。
若靜默: 「把問題拿著。不必大聲答。」
不要 道德說教成癮;邀請判斷。
把判斷裝成習慣
第四幕是手藝落地——六模組壓成習慣。沒有新理論;是大師規則變成學生星期一做得到的事。
不要念滿十二格。指第二欄說:三列同一動作——故意、及早交出錯答。再讀腳句。Kapur、梯度下降、agent 除錯是同一環;跳過嘗試教的是表演,不是遷移。訓練裡,錯 loss、漏切、靜 bug 才是真課綱。Agent 上,prompt 補丁修不好壞表徵。
圖說——一條路徑,三個走法。上四站(預測、嘗試、觀察、修正),下三線:學生、訓練中模型、生產 agent。第二欄是整頁的重心。
2026 實務:有目標、邊界、測試、歸屬的 spec,勝過一句 vibe prompt。Agent 先死在規格不足,不是能力不足。Grill-Me 是到這裡的路:一次一問、建議答案、接受-修改-否決,直到你能重述整棵樹。然後蓋章關閉再實作。
圖說——spec 六格;owner 用強調色——團隊最常留白。腳下 GRILL-CLOSED 是閘:上面什麼都別實作。
AIMA/CS188:先寫 Performance、Environment、Actuators、Sensors——再說狀態怎麼更新。沒有績效測試的 tool-agent,是會有副作用的聊天。先讓學生為具體東西寫 PEAS,再碰框架。
圖說——四欄,字母放大——帶得走的記憶法。腳句:沒績效測試的 tool-agent=有副作用的聊天。
展開狀態直到 goal test 成功。現代 agent planner 骨架仍是這個。廣度:一層層,路常較短,frontier 記憶長得快。深度:鑽再回溯,記憶省,可能離最優很遠。取捨是完備 vs 記憶、路徑品質 vs 省。
圖說——兩棵點樹。廣度:層層變寬、未探 frontier 虛線。深度:一條斜鏈、旁枝虛線。
Wirth 折,畫出來。左是多數 agent 真帶的:聊天紀錄。指著說實話——裡面沒有 goal,只有每回合重新從散文猜 goal 的材料;重新猜就是飄的來源。右是五個具名槽。右邊不更聰明,只是決定過了。氣味:若你修飄的方法是再加一段 prompt,你在用膠水修表徵問題。改形狀。
圖說——兩板。左:細線當 transcript,斜體寫 goal/step/risk——模型得在散文裡撈。右:五條有對位記號的槽。
約束畫成光圈疊加,因為本質就是這樣。從源頭說:第一天 agent 夠得到的,是你給行程的一切——API、檔、憑證。再左到右走四道槓。allow-list 不是政策文件,是洞;schema 是更窄的洞,因為型別呼叫機器能拒,段落只能靠付錢的人拒。
圖說——光束收四次。十九道射線;每道墨槓孔更小,被擋的停在點上——不戲劇,因為生產裡也不戲劇。只有三道到右。
一條線上一個數,數說不出的畫在周圍。先指空心環:那是模型開口前我們相信的;房間沒人說得出 prior,分數就無處可更新。箭頭是觀察,嘈雜——同輸入兩次不同數。實心點是 posterior,模型真正給的唯一東西。
圖說——分數線當儀器:prior 空心環、證據箭頭、posterior 實心點;對錯代價上下兩楔,門檻隨楔滑動。
Karpathy 折,圖就是論點,少解釋。右是學生第一次碰 AI 常見樣:三行 import、demo 能跑——不假、不壞,但不可讀。左是四刻度尺:你選特徵所以知道系統看得見什麼;你建笨基線所以知道容易半截值多少;小迴路是你自己的。
圖說——量尺對不透明團。左:四步刻度真尺。右:demo 作密網點——故意無可讀內部。
成本畫成真實階梯。從下走:儲存又寬又便宜又慢,到頂階又窄又金——每個生成 token 要活在生成那一瞬。頂是 HBM,稀缺不是軟體問題——廠、排隊、產業政策,變成你帳單上每千 token 的價。Wirth 定律附收據:軟體變胖,是因為記憶體階梯的形狀在邀它。
圖說——記憶階層真階梯:寬=每元容量,高=速度;頂階加工金。底下地線標電網與冷卻水。
四個開關,每一個都已扳好。別念標籤;改問房間:誰搬的?因為有人搬了,不是使用者。模型預設決定答案快且便宜還是慢且強、對話離不離得開大樓。工具預設決定壞日子夠得到什麼——最小權限是預設,不是事後功能。語氣預設回答「它在對誰說話」。
圖說——四條撥桿軌道,手柄已停好,虛線幽靈手柄在永遠到不了的位置。幽靈才是整圖。安全軌強調色。
Erlang 折,畫成他給的形:上監工、下工人、一條重啟。先說難受的——多 agent 預設就脆,不是意外:你串了多個非確定的東西。動作不是防光六種;是事先在程式裡決定每種炸時怎麼辦。走分支:超時重試/換模型/棄計劃;畸形輸出帶 schema 重問並隔離;工具熔斷降級;外文每次當不可信輸入;信心塌了升級給人——只有冷靜時建了升級路才可能。第六種人不記得:crash 的 worker 想把壞結果寫進長期記憶,橫槓擋住那箭——整課。Crash 便宜可復。毒記憶兩樣都不是。
圖說——監督樹。一監工六工人;第五劃掉並弧回重啟。第六支到長期記憶鼓,寫入被粗槓擋住。
第四幕最後一板,接回開場。四則,一位大師一則,畫出來不是引文——看得見的規則星期一用得上。Wirth:具名槽架——部件與資料先於膠水。Torvalds:特例被劃掉的枝——他不是更好地處理邊界,是改資料形狀刪條件。Matz:階梯上的滑線——階梯能走,人卻不愛走,享受不是裝飾。DHH:貫穿各層的薄豎切片——完整、有主張、已出貨,對上五框架觀光什麼都沒跑。標題出聲:裝上,不要偶像化。這些人紀錄裡都有你不會辯護的——所以規則綁樹幹,人留岸上。帶走一則當習慣,這場就成。一則夠。
圖說——四印:具名槽、劃掉特例的枝、階梯上滑線、貫四層薄豎切。同框同墨重。
見證 · 收束 · 天氣
第五幕。短。不要加新材料。回到霧板,把收束問交出去,每人一句見證。
與霧板同一八股力;每口井是 takeaway 圖。機制出聲走一遍。
十項。當自測不是量表——請學生默數此刻做得到幾項,數字只告訴自己。
圖說——兩欄十項,有號無勾框。默數,別公布。
放慢。三句。然後:一個所學、一個 AI 用法的改變、一個方向。主持也要說一件從房間學到的——這步不可省。
圖說——三粒給每人三件事,第四粒反色給主持欠房間的那件。第四粒不是裝飾。
封底。房間清空時留著——不要講過它。結束記號是印刷-30-,舊電訊「全文完」。
圖說——封面倒置:刊頭家具到底、logo 在底、套準到頂角。結束記號小板號-30-。
附錄三軌之第一。可換板:形是全球天氣→你們房間要交代的文件→結論。去馬來西亞或意大利教?1、3 幾乎不動,2 換成該國文書,引原文不引評論。四個日期出聲,讓房間發現都很近。沒有預測:每項是有日期的公開文件。地板正在別的房間澆置——所以 why 才是耐用技能。
圖說——一條時間線、四份文書。名與發布方在上,日期與約束在下。UNESCO 勾強調——其餘都坐在它裡面。
附錄三軌之第二——本地板,旅行時可換。數字皆出自發布方:國務院「人工智能+」意見的 2027/2030/2035;工信部 AI+ICT 2026–2028 網絡目標。底三份 2026 文書值得出聲:以為治理只在別處發生的學生,這是回答——涵蓋研究與公共服務的倫理審查、與網信辦發改委聯發的 agent 指引、把 AI 當公用設施而非產品的三年規劃。不要評論目標。讀、註日期與公開,讓房間自己得結論:野心公開,工作就可被公開檢查。
圖說——公開目標階梯,每階有日期墨板;底 2026 三文書作日期帶。上升因分期承諾,不是預測。
附錄三軌之第三。慢說,然後停。論點:地板會動、廠商會換、目標會改——都碰不到學生必須能答的那問:為什麼是這個,誰負責。所以課建在判斷不是工具上。旅行時這頁原樣保留;附錄唯一不本地的部分。
圖說——句子頁。一條規則、一道墨、無圖。兩頁別人的文件之後,房間只該看這句。
怎麼跑 · 出處
參考卡。講的時候不投影。
參考卡。第一、二幕背後全文,備課用。
僅供參考。海洋+衝突圖。
參考卡。模組圖與旅程表。
內部教學發行的來源與圖片出處。名冊肖像在 /portraits/,本頁列 credit。公開或商用前再核權利。圖解為本簡報原創。
第三幕深層操作:姿態、時間、架構板、衝突腳本。頁碼已對齊現行 87 頁主幹。
範圍: 簡報第 18–61 頁(海洋至衝突圖)
結構: 治理 → 四個架構,底下嵌 15 個具名停站 → 匯合 → 衝突圖
學生帶走的記憶結構: 迴路 Loop · 表徵 Representation · 氣質 Temperament · 堆疊 Stack
不是記憶結構: 十五份履歷等量背誦
> 「不是錯——是這次不上岸。海裡還有它。我們給它名字、量過,然後放它走。」
| 區塊 | 頁 | 時間 | 備註 |
|---|---|---|---|
| 治理 | 18–28 | 25–35 分 | 退回句不要趕 |
| A · 迴路 | 30–36 | 25–30 分 | 護住協同板 33 |
| B · 表徵 | 37–43 | 20–25 分 | 護住金句板 39 |
| C · 氣質 | 44–47 | 12–15 分 | 護住 Matz 那問 |
| D · 堆疊 | 48–53 | 15–18 分 | 三明治板 51 |
| 匯合 + 衝突 | 54–61 | 20–25 分 | 至少完整走完一條軸 |
| 合計 | | 約 2–2.5 小時 | 壓縮見 §8 |
若海洋只有 60–75 分: 治理速覽(退回 + 量尺)→ A 全走 → Wirth 金句 + 堆疊三明治 → 衝突優先軸 → 匯合一問。
說: 地板比這門課更老、更大——校本框架 + UNESCO。
不要: 變成合規講座。把欄杆讀清楚一次就夠。
往前接: UNESCO 板上的環境/能源 → 接回霧板,不是註腳。
實例(26): Torvalds 2018——分拆上岸。品味課上岸;言行只點名、不示範。
27: 退回句要原句教。找一位同學的想法練習一次。
六條都不會永久結案。按系統、按層重選。 橋到航程:習慣把架構裝進練習。
18(30 秒)→ 27 退回 → 28 → A 30–36 全走 → 39 金句 → 51 三明治 → 54 → 59、60、61 → 停
27 → 33 協同 → 36 承認 → 39 → 51 → 55 總覽 + 只做 60 → Matz 那問口說、C 不全走
二次回味、完整咖啡館故事、Rust 生態、五聲音名字(留住那問)、DHH 雲數字
33 協同 · 36 承認 · 39 金句 · 退回原句 · 59/60/61 至少一條
| 學生說 | 你回 |
|---|---|
| 「所以哪位大師才對?」 | 沒有永久對。選一個系統、一層。 |
| 「AI 會讓這些過時。」 | 那判斷會更貴,不是更便宜。這就是主線。 |
| 「我已經很會用 ChatGPT。」 | 給我看你的失敗紀錄。說出縫在哪。(Kapur。) |
| 「這只是哲學。」 | 39 和 51 是工程。表徵和堆疊是承重牆。 |
| 護偶像/攻人身 | 治理量尺。分拆上岸。想法 ≠ 言行。 |
| 想聽更多生平 | 「Vault 有深度。這房間裝的是架構。」 |
| Matz 那問令他不自在 | 好。不要救。氣質軸在工作。 |
| 「再加進 prompt 就好」 | 第 60 頁。再說一次 Wirth 那句。 |
| 架構 | 航程習慣 |
|---|---|
| 迴路 | 有產出的失敗循環 · Grill-Me/先 spec 再工具 |
| 表徵 | 狀態設計 · PEAS · 約束 · 特徵優先 · 評測識字 |
| 氣質 | 預設即倫理 · 成本作約束 · 品味四則 |
| 堆疊 | 監督失敗 · 硬停止 · 拒絕猜測 |
「海為架構命名。航程把它們裝成習慣。」
projects/iits/masterclass-*.md若學生要「十五位全部深挖」:指向完整 spine/Bonus,不要答應把海洋重跑成傳記之夜。