RAG
-
智能低代码平台落地路径(详解华为云 Astro 的产品族与 AI 原生能力)
把业务应用从”拖拽组件”推进到”用自然语言描述需求就能生成”,是近几年低代码平台最显著的能力跃迁。华为云 Astro 以零码、轻应用…
-
大模型能力评估方法与主流 Benchmark(评测体系与选型对比)
MMLU、HumanEval、GSM8K 这套组合在 2025 年前后已经被沿用多年,主流的大模型评测体系也已形成两条线:通用知识与推理(以 MMLU、HellaSwag、ARC …
-
Prompt 注入攻击概念详解(详解常见类型、OWASP LLM01 与七层防御)
某天客服 Agent 突然按一封邮件里的”指令”给陌生账户办了退款,代码 Agent 读了一个 GitHub issue 后把私有仓库内容写进了公开 PR—…
-
上下文工程定义解析(详解 2026 年 AI Agent 关键工程能力)
截至 2026 年,上下文工程已成为 AI Agent 落地链路中权重靠前的工程技能——它解决的不是”怎么写提示词”,而是”模型在每个决策瞬间能…
-
红队测试(Red Teaming)概念详解(大模型应用安全测试方法)
红队测试(Red Teaming)是对大模型应用进行对抗性安全评估的工程实践——通过系统化的攻击者视角,主动发现 Prompt 注入、越狱、数据泄露、工具滥用、供应链投毒等真实风险…
-
大模型的上下文窗口(Context Window)详解(应用开发选型影响)
上下文窗口(Context Window)是 LLM 在一次推理中能”同时看到”的最大 token 数,包括系统提示、对话历史、用户输入和模型输出;2024…
-
Token 缓存机制详解:降低 AI 应用调用成本的方法
Token 缓存(Prompt Caching)是把”每次都要重复发送的 prompt 前缀”在模型服务侧存下来,下次匹配上就只对增量部分重新计费的机制;2…
-
AI 幻觉概念详解(附:大模型产生幻觉的成因与缓解方法)
AI 幻觉是指大模型在生成文本时输出”看似流畅自信、实际与事实或上下文不符”的内容——它并不是模型”撒谎”,而是其基于统计规律预测下…
-
AI Agent 生产环境安全防护(7 类风险与防御实战)
把 Agent 推上生产,安全和功能同等重要——一个被 prompt 注入攻破的 Agent 可能在几分钟内把数据库里的敏感数据吐给攻击者,一个权限过宽的 MCP Server 可…
-
AI Agent 长期记忆设计指南(存储架构与检索方案全拆解)
把会话窗口当记忆用是 Agent 一个常见的设计误区——上下文窗口是有限、昂贵、不可扩展的。长期记忆必须落到外部存储里,常见做法是”向量库 + 知识图谱 + 事件日志&…