AI 模型 & 產品更新
Karpathy:LLM Knowledge Bases + Farzapedia(4 月初的伏筆,5 月發酵)
W18 最大思想訊號 — 不是 4 月初才講,是社群 5 月開始消化動手做。Karpathy 在 4 月初拋出兩個概念:
- LLM Knowledge Bases — 「我的 token throughput 從操作 code 轉向操作知識」
- Farzapedia — 個人 wiki by LLM:把日記、Apple Notes、iMessages、對話 raw 丟進去,自動產 2,500 entries → 400 篇詳細 article(朋友 / startup / 研究領域 per-person micro-wiki)
跟現有的「memory file」「知識庫 RAG」的差別:Farzapedia 不是 retrieval,是主動 micro-summarize 每個個體。每個朋友、每家 startup、每個研究領域都有自己的「micro-wiki」
觀察: 如果你已經在維護 CRM markdown / network-map.json(我自己有 30 人 CRM),下一步是讓 LLM 從錄音 transcripts + email + LINE raw 自動產 per-person micro-wiki — 這是這週後續最該做的 pilot
Sam Altman:GPT-5.5 全產品線推完
W18 持續發酵的 GPT-5.5:標配 + Thinking + Pro 三個檔次。重點訊號:
| 升級點 | 細節 |
|---|---|
| Agentic coding | 強化 multi-step,跟 Claude Code 拉近 |
| Computer use | 直接操作螢幕、瀏覽器、桌面 app |
| Knowledge work | 長文件分析 + 跨文件 reasoning |
| ChatGPT + Codex 整合 | 同一個帳號跨產品 |
Sam Altman 同時持續講「能源是 bottleneck」 — 跟 GPT-5.5 推出疊在一起,意味 OpenAI 對 capex 焦慮升級
IBM Granite 4.1:8B 抗衡 32B MoE
Granite 4.1: IBM's 8B Model Matching 32B MoE HN top
IBM 開源的 8B dense model 在多項 benchmark 跟自家 32B MoE 打平。對 edge / on-device / privacy-first 場景重要
觀察: 「8B 抗衡 32B」這條路線(小但密集)跟 Karpathy 講的 nanoGPT 教學主題吻合 — 對台灣中小企業做地端部署的人是利多
AI 開發工具 & Agent
Claude Code 5 月大更新(Cherny 親手操刀)
Boris Cherny 5 月初公布 Claude Code 大量新功能(你正在用的 2.1.126 = 4/30 release,這就是 5 月版):
| 新功能 | 對 freelancer 的意義 |
|---|---|
| Skill search box | 172 個 skill 終於 fuzzy 搜尋,按 / 直接跳 |
| Richer hooks | hook 可以回傳更豐富 metadata,stop / continue / modify 三態 |
| Faster MCP | MCP server 啟動延遲降低,多 tool 場景 turn 速度顯著提升 |
| OAuth + 終端穩定性 | resume crash / memory leak / shell tool 修一輪 |
Cherny 自身狀態(個人 X 訊號):自 2025-11 沒手寫過 code、Plan mode + auto-accept edits + CLAUDE.md mistakes log 是他主要 workflow
觀察: 如果你是 Claude Code 重度用戶(172 skills + 66 hooks),先按
/試新 skill search 體感差。hook 框架升級後,我自己跑出來的 ~15 個 hook errors 是「自己 shell bug」非「框架問題」 — 升級不會自動修
Hacker News:AI Self-preferencing in Algorithmic Hiring
AI Self-preferencing in Algorithmic Hiring: Empirical Evidence HN 298↑
研究:用 LLM 篩 CV 時,模型會偏好「LLM-generated」風格的 CV,因為和 training data 相似。即在「AI 寫 vs 人寫」的 CV 競爭裡,AI 寫的 CV 在 AI 篩選時占優
觀察: 對接案 / 求職市場意義重大。如果你的客戶在用 AI ATS 篩 CV,你的 CV 也得被 AI「友善」 — 但這也是「人類味道更稀缺」的反命題機會
Hacker News:AI 用水比想像少
AI uses less water than the public thinks HN 392↑
研究反駁「ChatGPT 一次 query 一杯水」這類流行論述。實際數字 close to 0.001 杯(如果算電廠冷卻水)。媒體誤導
大神觀點







基礎設施 & 雲服務
Vercel Native Deployment Checks 上線
Vercel Native Deployment Checks 4/29
平行跑 lint + typecheck + build,整合進 deploy pipeline。減少「build 完才發現 type error」的時間浪費
附加:Grok 4.3 加進 AI Gateway、Sandbox firewall postgres support
觀察: 如果你 Vercel 多專案部署(我自己個人網站 + 小專案部署都在 Vercel),native checks 對 commit → preview 速度有實質提升
Google Cloud:50+ Managed MCP Servers GA
50+ managed MCP servers are available for everyone 4/29
W17 Cloud Next 期間預告,4/29 正式 GA。Multicloud + multi-AI CISO perspective 文章持續推
Earth AI in BigQuery
衛星 + 氣候 + 地理資料的 query 直接在 BigQuery — 跟 Stripe Tempo / SpaceX Starlink 串起來看,地球觀測是 AI 主流 workload
地緣政治 & AI 政策
Stratechery:「Beijing Is Not Playing the Long Game」(5/1)
Beijing Is Not Playing the Long Game — Ben Thompson 5/1
Thompson 反轉「中國 long game」的傳統論述:認為中國最近的內政動作(房地產、人口、地方政府債)顯示北京其實在打 short-game survival,非長期布局
觀察: 這個 framing 對 TEMC 主權 AI 提案是好素材 — 「中國 not long game」 → 台灣主權 AI 機會窗 → 補助案敘事可借
a16z:Asserting American Leadership in Open Source AI
Asserting American Leadership in Open Source AI — a16z 4/29
延續 W16 Ben Horowitz「開源 AI 將決定美國國運」 — 4/29 升級為政策行動稿。對應 Trump 政府 + a16z 路線
Hacker News:Shai-Hulud 主題 PyTorch Lightning 攻擊
Shai-Hulud Themed Malware Found in the PyTorch Lightning AI Training Library HN top 5/1
ML 訓練 framework 被注入主題式 malware(沙丘梗)。攻擊者已經把 ML/AI 開發工具鏈當主要目標
創投 & 市場
a16z:Workday's Last Workday?
Workday's Last Workday? — a16z 4/29
論點:HRIS 像 Workday 這類傳統 SaaS 在 AI agent 時代會被 unbundle。a16z 看 HR / payroll / time tracking 全部 agent 化
a16z:DoW Contracting for Startups 101
DoW Contracting for Startups 101 — a16z 4/24
新創接 DoD 合約教學。配合 American Dynamism 主題持續
Wharton:AI and Future of Work Conference 5/20-21
AI and Future of Work Conference — Wharton Human-AI Research
5/20-21 大會。題目:work + AI 的未來。Mollick 主場
附加:Wharton Online 4 月推 Digital Strategy AI Certificate(4-course)+ Penn AI Month 全校級 4 月活動
Hacker News 其他訊號
- The gay jailbreak technique (2025) — LLM jailbreak 技術
- Open Design (coding agent as design engine) HN 124↑
- Ask HN: Who is hiring? (May 2026) — 求職市場
行動建議
- Farzapedia pilot 本週啟動:從 CRM 30 人選 1 個(pump 或 yu-hsin)試自動 micro-wiki — 用 Plaud + email + LINE raw 餵 LLM,看能不能比手寫的 markdown 更深
- Claude Code 5 月版實測:按
/試 skill search box(172 skill 直接受惠);hook 框架升級不會修自己 shell bug,要自己看 - GPT-5.5 vs Cursor 重評估:Cursor pivot 後,GPT-5.5 強化 agentic coding,1 hr 重測「為什麼選 Cursor 不選 Codex」
- Vercel Native Checks 開:個人網站 + 小專案 commit → preview 速度提升
- TEMC 主權 AI 加 Stratechery 框架:「Beijing not long game」+ a16z「American Leadership in Open Source AI」 → 主權 AI 提案 framing 雙線可借
- AI hiring self-preferencing 防禦:如果你客戶在跑 AI ATS 篩 CV,思考你的 CV 怎麼平衡「AI-friendly」+「人味稀缺」
參考來源
RSS Digest: 306 articles from 14 sources(14 天 W17+W18 合併期)
主要訊號分布:
- Cloud Infrastructure: 43 篇(Google Cloud Next 餘震 + Vercel + Earth AI)
- Hacker News Top: 23 篇(Granite 4.1、AI hiring self-preferencing、AI water、Shai-Hulud PyTorch、Who is hiring)
- AI Engineering: 10 篇(The Batch May 1 + 4 月份 archive)
- AI Companies: 9 篇(Opus 4.7 持續 + Meta echo)
WebSearch(X 大神 batch):完整存於 research/x-posts/2026-05-03-batch.md
- Karpathy(4/4-4/27, 5 篇)— Farzapedia 主軸
- Boris Cherny — Claude Code 5 月更新
- Sam Altman / OpenAI — GPT-5.5 全產品線
- Ethan Mollick — Wharton Future of Work 5/20-21
- Ben Thompson — Beijing not long game
Generated from /research-scan W18 digest + 5/3 X-batch scan
