AI 前沿研究與工程實作
追蹤新技術、拆解系統架構,也公開真正動手做過的評測與實作。
文章封存|第 2 頁
- Gemini Antigravity Agent 09-2026:一次 Agent Runtime 的 Protocol Migration
拆解 Antigravity Agent 09-2026 的 remote/local 相容性邊界、內建工具契約變更、adapter 設計與 contract tests,並整理 05-2026 在 2026-10-05 退場前的遷移風險。
- AWS Bedrock AgentCore 解決文件漂移:把 Code、RAG 與 MCP 寫入邊界分開
拆解 AWS 與 Corley 為 Eutelsat 展示的文件同步 Agent:以程式碼作為 source of truth,用 RAG 補上領域語言,並把 MCP 寫入與人工審查留在可治理的發布邊界。
- Amazon SageMaker HyperPod Inference Gateway:GPU-aware routing 的價值與邊界
拆解 Amazon SageMaker HyperPod Inference Gateway 如何用 KV cache、queue depth、LoRA 與 prefix cache 訊號做 Kubernetes-native 路由,並核對 EKS add-on、CRD、失敗行為與 AWS benchmark 的證據邊界。
- Claude 如何把生物分子模型跑得更快:從 FlashPairformer 到可回退的 Inference Kits
拆解 Anthropic 讓 Claude 優化 30 多個生物分子與基因組模型的工程方法,從 FlashPairformer、Big mode、stock/exact/fast 契約,到 GPU 成本與可驗證性邊界。
- TypeSafe AI 與 Jev:把 AI 變成可校準的決策元件
拆解 TypeSafe AI 的 System One 模型與 Jev,理解 typed decisions、機率信心、workflow evals,以及它和一般 LLM structured output 的差異。
- Jev 實戰架構:把 Confidence-Gated Routing 放進 Agent Runtime
不再重述 Jev 的基本介紹,改從 confidence-gated routing、speculative fan-out、composite scoring 與社群實驗,拆解如何把 AI 判斷放在 Agent、工具與人工審查之間。
- AWS Bedrock AgentCore Consent Portal:Agent 的 OAuth 不只是按下 Connect
拆解 Amazon Bedrock AgentCore Consent Portal 的 end-user OAuth flow:如何分開 corporate IdP、Gateway、GitHub/Slack outbound provider、callback、session binding、token vault 與 CloudTrail,並標出 AWS reference walkthrough 沒有證明的安全邊界。
- Redpanda Agentic Data Plane v0.2.61:把憑證、Context 與寫入權限推到 Agent 邊界
整理 Redpanda Agentic Data Plane v0.2.61/v0.2.60 的 credential passthrough、context estimate、activity filtering 與 Pylon capability gates,並回看 v0.2.58 的 audit semantics。
- Gemini 3.8 Flash Coding Agent 工作流:以不確定性路由規劃與執行
以 Astra 規劃、Flash 執行為例,說明如何在 Coding Agent 工作流加入 SPEC 查核、升級條件與成本評估。
- Unified Knowledge Graph RAG:GraphRAG 與 LightRAG 是 Query Policy,不是全域開關
拆解 AWS 的 Unified Knowledge Graph RAG 參考架構:GraphRAG 與 LightRAG 如何共用入庫、圖譜、Hybrid Retrieval 與 lineage,再按問題選擇查詢策略,並解讀品質、成本與延遲取捨。
- AWS Step Functions × Bedrock AgentCore:讓 Agent 提案先過驗證,再碰關鍵狀態
用 AWS Step Functions 編排 Bedrock AgentCore 多代理流程,把提案、確定性驗證、人工核准與執行拆成可重試、可稽核的控制邊界。
- GitSpawn:當 Repository 的 Git Config 先於 Coding Agent 的信任邊界執行
拆解 GitSpawn 如何透過 repository-local 的 core.fsmonitor 觸發背景命令,穿過 coding agent 的 workspace trust 與 approval 邊界,並整理 archive 交付條件、修補矩陣、安全重現界線與企業控制。
- Forge v0.18.1:開源多使用者 MCP Auth 與 Agent Governance
拆解 Forge v0.18.1 如何把多使用者 MCP 的身分、OAuth 同意、租戶、政策、出口與逐次稽核串成可檢查的 Agent runtime contract,並標出尚未被獨立驗證的邊界。
- AG2 v1.0.3:MCP 2.0 Migration 與確定性 Agent Governance
拆解 AG2 v1.0.3 的 MCP 2.0 breaking migration、TealTiger deterministic governance 與可驗證的 Agent runtime rollout 邊界。
- Model Hardware Standard:給實體裝置的 MCP 形狀介面
拆解 Anthropic Model Hardware Standard 研究預覽:它標準化 Agent 與可程式化硬體之間的驅動、探索與操作介面,但不取代平台的身分、授權、審批與實體安全控制。
- Automated Alignment Researchers:Agentic Post-Training 為何需要 Integrity Gates
拆解 Anthropic 的 automated alignment researcher 實驗:Agent 可以搜尋、訓練與迭代 post-training 方法,但 benchmark、能力門檻、資料隔離與完整性審查必須由外部 gate 固定。
- WeKnora 架構解析:從文件入庫到可治理的 Agent 知識平台
拆解 Tencent WeKnora 的三進程核心、文件解析與檢索資料流,並說明 Agent、MCP、sandbox、memory 與企業治理如何接在同一個控制面。
- LLM 推論成本怎麼算?從 DeepSeek-R1 實測到 GPU 租價
以 DeepSeek-R1 的 MLPerf 公開紀錄對照 8 張 B200/B300 的吞吐與延遲,再用有來源的 GPU 租價試算成本,分清實測、算術推導與 API 售價。
歡迎演講、企業內部技術分享與架構交流;可以先查看我適合分享的主題與公開工程成果。
演講與聯絡