Hex 怎麼做資料 Agent: 難的不是寫 SQL,是沒辦法驗證答案對不對

AgentDataEvalContext Engineering

「很難 eval」是產品設計的警訊: 讓 AI 輸出可驗證、可信任的 UX 設計

EvalProduct

2026 年的 RAG 最新發展: 瓶頸不在模型,也不在檢索,在文件解析

RAGWorkflowAgent

倢愷 Oscar 的 Agent Harness 四部曲導讀: 從 function call 到 LLM Wiki

AgentTool UseSkillRAG

Matt Pocock 的 Agent Skill 設計哲學

SkillCodingAgentContext Engineering

LLM-as-Judge 與其打總分,不如拆解成 Yes/No 檢核清單

EvalPrompt

Agents' Last Exam: 測 AI Agent 能不能真的上工,順便盤點還沒飽和的 Agent benchmark

AgentEvalBenchmark

為什麼 context window 會卡在 1M 很多年? SemiAnalysis 談 40 年一遇的記憶體短缺

IndustryLLMContext Engineering

如何萃取老師傅的知識做成 Agent Skill? 六條路線的方法論框架

AgentSkillKnowledge Base

Claude Fable 5 的 Prompting 要點: 該刪的比該加的多

PromptAgentLLM

你的 Prompt 通得過 The Mom Test 嗎? 如何避免 LLM 的迎合問題

PromptLLM

Marc Andreessen: AI 是 80 年的一夜成功,而真正的阻力不是技術

AgentIndustryCoding