名詞對照表

出現頻率最高、以及需要另外查過才說得清楚的名詞。

兩天下來出現頻率最高、以及需要另外查證才說得清楚的名詞,集中放這裡。台灣在地的專案與產品另外開一節,因為那些在英文資料裡通常查不到。每一條盡量附官方連結,查不到來源的就標明。

64 個名詞

1. 模型與研究

Transformer
2017 年提出的類神經網路架構,當代大型語言模型的技術基礎

出現在紀懷新、吳柏翰、林彥廷

seq2seq learning
序列到序列學習,機器翻譯從統計對照表轉向類神經網路的關鍵

出現在紀懷新

Chain of Thought
思維鏈,讓模型輸出中間推理步驟以提升解題能力

出現在紀懷新

LaMDA
Google 早期的對話語言模型,技術路線後續演進為 Bard 與 Gemini

出現在紀懷新

Gemini
Google 目前的多模態模型系列

出現在紀懷新、吳振和、陳志信

Project Astra
Google DeepMind 的通用 AI 助理研究原型

出現在紀懷新

Gemini Robotics
把 Gemini 的多模態能力延伸到機器人控制

出現在紀懷新

知識蒸餾 Knowledge Distillation
用大模型的輸出教小模型,讓小模型逼近大模型表現

出現在吳柏翰

Test-time scaling
推論階段多花算力換取更好答案,例如多次取樣或延長推理

出現在吳柏翰、林彥廷

Zero-shot
模型沒有針對該任務訓練過就能完成

出現在紀懷新

System 1/System 2
借用快思慢想的雙系統理論,對應直覺式與深度推理式任務

出現在紀懷新

Sycophancy
模型為了迎合使用者而犧牲正確性的傾向

出現在林彥廷

Rejection sampling
同一題重複取樣、只留答對的結果來生成訓練資料

出現在林彥廷

2. 評測與基準

MATH 資料集
高難度數學解題評測資料集

出現在林彥廷

GPQA
研究生等級、標榜搜尋引擎查不到答案的問答評測

出現在林彥廷

SWE-bench
評測 AI 解決真實軟體工程 issue 的能力

出現在林彥廷

HealthBench
OpenAI 推出的醫療領域評分規準式評測

出現在林彥廷

PaperBench
評測 AI 複現學術論文的能力

出現在林彥廷

LM Arena
讓使用者對兩個模型回答投票、藉此排名的對戰式平台

出現在林彥廷

Preparedness Framework
OpenAI 追蹤模型能力與風險的評估框架

出現在林彥廷

Rubric(評分規準)
針對單一問題逐條列出評分標準,可讓模型當評分者

出現在林彥廷、吳剛志

Eval-Driven Development
先建立評估機制再開發 LLM 應用

出現在吳剛志(引用 ihower)

正確率與覆蓋率
覆蓋率是 AI 有回答的比例,正確率是有回答之中答對的比例

出現在吳剛志

3. 代理人與協定

Model Context Protocol(MCP)
讓 AI 應用連接外部資料與工具的開放協定

出現在張文鈿、保哥、黃仕鎮

MCP 的三種原語 Tools/Resources/Prompts
分別對應可呼叫的工具、可讀取的資料、可套用的提示範本

出現在張文鈿

stdio 與 Streamable HTTP
MCP 的兩種傳輸方式,前者跑在地端行程之間,後者走網路

出現在張文鈿

Sampling 與 Roots
MCP 中由伺服器反向請求模型推論、以及宣告可存取根目錄的機制

出現在張文鈿

Agent2Agent(A2A)
Google 提出的代理人之間互通協定,與 MCP 解決的問題不同層

出現在張文鈿

Claude Computer Use
讓模型直接操作螢幕、滑鼠與鍵盤

出現在Wisely Chen、Peggy Lo

Browser Use
開源瀏覽器自動化框架,除了截圖也解析 HTML 結構

出現在Wisely Chen

Human-in-the-loop
在自動化流程中保留人類確認關卡

出現在Caesar Chi、保哥

Supervisor 架構
由一個上層代理人分派任務給下層代理人的組織方式

出現在Caesar Chi

4. 開發工具

GitHub Copilot
GitHub 的 AI 編碼助理,Agent mode 可跨檔案修改並呼叫外部工具

出現在林鉦育、保哥

Claude Code
Anthropic 的代理式編碼工具

出現在保哥

CursorWindsurf
兩款以 AI 為核心的編輯器

出現在Peggy Lo、Vivi Chen、張文鈿

n8n
開源的工作流自動化平台,可自架

出現在高見龍、Vivi Chen

Dify
可視化的代理人與檢索工作流開發平台

出現在吳剛志、張文鈿

Google Apps Script
綁在 Google 試算表與雲端硬碟上的指令碼平台,非工程師最常見的第一個自動化入口

出現在Peggy Lo、Vivi Chen、鄭晴元

Mermaid
用純文字寫流程圖的語法,機器與人都讀得懂

出現在鄭晴元、吳剛志

CrewAILangChain
兩套多代理人與 LLM 應用開發框架

出現在Caesar Chi

MCP Inspector
官方提供的 MCP 伺服器除錯工具

出現在張文鈿

5. 檢索、多模態與資料

RAG(檢索增強生成)
先從知識庫檢索再生成,讓模型回答有依據

出現在黃仕鎮、吳振和、Caesar Chi

多模態 RAG
檢索對象不只文字,還包含圖片與影音

出現在吳振和

OCR 與不特定格式辨識
固定格式的辨識準確度可以做到很高,不特定格式才是難題

出現在黃仕鎮

DLP(資料外洩防護)
送往外部模型前先遮罩機敏資訊的機制

出現在黃仕鎮

Function Calling 與 JSON Mode
讓模型輸出結構化結果、可直接被程式使用的兩種做法

出現在吳剛志

6. 影像與影音創作

荷蘭角(Dutch Angle)
刻意傾斜構圖製造不安感的攝影手法

出現在陳志信

參考點技巧
用顏色標記取代左右前後這類方向詞,引導模型生成動作

出現在陳志信

借位合成
保留實拍場景的光線與環境,替換畫面中的人物

出現在陳志信

Copy-move/Splicing/Retouching/Cropping/Blurring
五種傳統影像造假手法

出現在李怡志

7. 資訊識讀與心理學

Source Monitoring Framework
判斷一則記憶來源的心理學框架

出現在李怡志

捷思式判斷與系統式判斷
雙軌資訊處理模型,滑社群時多半用前者

出現在李怡志

知識落差效應
資訊量越大,已知與未知之間的落差越容易被利用

出現在李怡志

證實偏誤
只要符合既有立場就傾向相信

出現在李怡志

8. 台灣在地專案與產品

這一節是英文資料查不到、但在台灣社群裡會一直聽到的名字。

Taiwan LLM(Taiwan-LLaMa)
林彥廷開發的繁體中文大型語言模型專案

出現在GitHub

APMIC
吳柏翰創辦的企業 AI 公司,主打企業專屬模型微調與地端部署

出現在官網

GENIE
玉山銀行行內自建的生成式 AI 對話平台

出現在講者自述,無外部來源佐證

智能會議紀錄服務
玉山銀行行內自建的會議摘要與待辦擷取服務

出現在講者自述,無外部來源佐證

伸手牌
簡訊設計內部開發、用表情符號觸發的 Slack AI 機器人

出現在講者自述,無外部來源佐證

Cympack
Caesar Chi 團隊做的包裝設計到製造協作平台

出現在Cympotek

Botsnova
劉詩雁創辦的公司,本次分享日化印刷的 AI 導入案例

出現在INSIDE 專訪

志祺七七
簡訊設計旗下的 YouTube 頻道

出現在頻道

五倍學院
高見龍共同創辦的技術教育品牌

出現在官網

AI Engineer 電子報
張文鈿經營的生成式 AI 工程電子報

出現在ihower.tw

9. 主要資料來源

項目來源
MCP 規格與原語定義Model Context Protocol 官方文件
評估方法論Anthropic:定義成功標準與建立評估
評估驅動開發ihower:評估驅動開發
講者與講題對照議程總覽

English