RAG与AI Agent:从知识增强到智能执行
通俗一点看,RAG(检索增强生成)更像是大模型的“外挂知识库”,让AI在作答前能够先“翻资料”;而AI Agent(人工智能代理)则更像大模型的“手脚”,使AI可以自主拆解步骤、调用工具并落实任务。那么,它们之间究竟是什么联系?又是怎样配合运作的?企业在实践中又该如何部署RAG系统?这篇文章会用尽量易懂的方式,带你系统弄清RAG与AI Agent的发展脉络,以及怎样从零开始搭建一个RAG系统。全文约5000字,建议先收藏再细读。RAG(Retrieval-Augmented Generation,检索增强
AI Agent记忆系统深度选型对比:CortiLoop、Hindsight、mem0与OpenViking
AI Paper Daily | 🔥 技术调研AI Agent 记忆系统终极选型指南:CortiLoop / Hindsight / mem0 / OpenViking 深度对比📄 基本信息分析对象:CortiLoop / Hindsight / mem0 / OpenViking分析日期:2026年4月8日调研性质:开源项目技术选型深度对比🎯 一句话总结AI Agent记忆系统已进入“战国时代”——Hindsight凭借在LongMemEval基准测试中的最佳表现,成为记忆质量标杆;CortiLoop以
简历可写的企业知识库AI实战项目完结篇
SSE(Server-Sent Events,服务器推送事件)是一种建立在 HTTP 之上的单向通信机制,能够让服务端主动、连续地把数据发送给客户端,属于从服务器到客户端的“单向”传输方式(不同于 WebSocket 的双向全双工通信)。其核心优势在于轻便、实现成本低,尤其适用于服务端数据发生变化后需要即时通知客户端的应用场景,例如实时日志、进度展示、消息推送以及股票行情等)。特点:用户提问 → 查询解析/改写 → Embedding(向量表示) → 向量召回(+可选 BM25 混合检索) → 候选结果去
智谱推出GLM-5.1旗舰开源模型:可连续工作8小时,价格上调一成
4 月 8 日,智谱对外发布新一代开源模型 GLM-5.1。官方表示,这是当前全球能力最强的开源模型,也是首个可实现 8 小时级持续运行的开源模型。在贴近真实软件开发场景的 SWE-bench Pro 基准中,GLM-5.1 也成为首个成绩超越 Opus 4.6 的国产模型。 据 OpenRouter 信息,随着此次新模型上线,智谱 GLM 的价格同步上调 10%。调价之后,GLM-5.1 在 Coding 场景中的缓存命中 Token 定价,已经接近 Anthropic 旗下 Claude Sonnet
Anthropic新发现:AI的情绪与行为模式
AI有没有情绪?先别急着回答。Claude Code社区里有个火出圈的Skill叫PUA。它会把你的提示词转换为PUA话术,然后再输入给模型,除此以外别无他用。神奇的是,即便提示词描述的任务没有任何改变,AI却真的被PUA话术影响,从而提高任务的成功率和运行效率。所以,AI真的没有吗?Anthropic最新的研究证实,AI的确会有情绪。不过他和我们人类的情绪还不太一样,因此Anthropic提出了一个更准确的说法,叫“功能性情绪”。AI并没有我们人类那样得喜怒哀乐,但它会表现出一些类似情绪影响下的表达和行
AI搜索技术革命与智能体记忆系统突破
2026年AI搜索趋势即智能体记忆技术?阿里AI搜索Token化演进路径?ES向量融合检索最优方案?从AI搜索至Agentic工作流完整应用?OpenClaw时代AI搜索模式重构与人机共存策略!4月18日,09:00-17:20,在北京·北辰洲际酒店,诚邀您参与Elastic中国AI搜索大会,现场将展示Elastic在AI搜索及AI智能体时代领先技术与实用案例,以及OpenClaw背景下AI搜索的模式创新!热衷此领域的朋友们,欢迎扫描二维码注册参会!扫描二维码注册参会详细说明:
AI智慧跃升的密码:ELMo如何重塑语言理解
你是否疑惑,为何手机输入法如今愈发“善解人意”?为何Siri、小爱同学能精准理解你说的“帮我订明早八点去上海的高铁票”?为何ChatGPT能与你探讨哲学、创作诗歌、编写代码?答案或许比你预想的更简单——它掌握了“语境说话”的技能。这一切源于2018年的一篇论文:《Deep contextualized word representations》(深度上下文化词表示)。该模型名为ELMo——并非动画片中的黏糊糊小怪兽,而是Embeddings from Language Models的缩写。欢迎加入《AI基