Skip to content
所有標籤

#hallucination

5 篇文章
ai deep-dive AI 頂會導讀

2023 AI 頂會導讀:自然語言處理篇

2023 年是 ChatGPT 之後的第一個完整學術年——NLP 頂會的議程被 LLM 全面重寫:ACL 的 Best Paper 研究幽默理解和政治偏見追蹤,EMNLP 的 Best Paper 用資訊流視角解釋 in-context learning,而 HackAPrompt 這篇 prompt injection 競賽論文直接拿下 EMNLP Best Paper,標誌著安全研究正式進入主流。整年最大的主題轉變是:研究者不再問「怎麼讓模型更準」,開始問「怎麼知道模型在不在騙你」。

ai deep-dive AI 頂會導讀

2023 AI 頂會在收什麼題目:LLM 重寫研究議程的一年

2023 年是 LLM 全面重寫 AI 研究議程的第一年:DPO 拿下 NeurIPS Outstanding Runner-Up、ReAct 成為 ICLR Oral、hallucination 從邊緣詞彙變成每場會議的熱門 track——同時 3D Gaussian Splatting 在 SIGGRAPH 發表後橫掃 CV 社群,Mamba 年底出現挑戰 Transformer 的注意力壟斷,而傳統 NLP pipeline 的論文量開始明確萎縮。

tech deep-dive

台股研究 Agent 實戰系列(篇 6):讓 LLM 報告的每個數字都可稽核

LLM 寫報告時最容易幻覺的不是觀點而是數字,所以我把所有可信數字建成 SHA-256 定址的 evidence manifest,LLM 只能引用 {{fact.id}},膽敢寫裸數字就整份丟棄回退規則模板。

CS224N 第 16 講:Hallucination、創造力、工作與價值對齊

第 16 講把 NLP 的社會影響拆成四題:模型為何 hallucinate、AI 輔助創作的同質化悖論、工作如何重組,以及價值對齊為何不能化約成單一 reward。

Stanford CS224V 第 5 講:WikiChat 的七階段 RAG 如何逐條攔下幻覺

WikiChat 不把檢索結果直接交給一次生成,而是形成查詢、檢索、過濾、生成、拆主張、再檢索查核與移除無根據內容,並把檢索與事實性分開評估。