标签

从零构建 AI Agent:手写实现最小可用智能体

这是《从零构建 AI Agent》系列指南的开篇之作,推荐循序渐进地学习。智能体(Agent)已成为人工智能领域最受瞩目的方向。然而初学者往往一上来就使用 LangChain、AutoGPT 等现成框架,跑通示例后一旦遇到错误便束手无策。根源何在?这些框架将底层机制过度封装。工具调用逻辑、错误信息处理等细节都被隐藏,排障时不得不深入源码追踪。因此,亲手实现 Agent 的目的并非"重复造轮",而在于掌握轮子运转的内在原理。作为该系列的首篇文章,它将带你实现一个可运行的极简 Agent 类,核心代码仅约 6

2026-04-25 15:31:45  |  16 阅读

人工智能的心理学新解:具身认知视角

从人工智能的三大理论流派来看,行为主义缺乏认知成分,而联结主义特别是符号主义关注概念性知识的表征与加工,但都未涉及认知与身体及外部环境的直接互动,这种脱离身体的认知被称为离身认知。就人类认知而言,以符号形式呈现的概念和知识,如数字、文字、模式及规则等,其形成、发展与运用不仅与个体的感知运动体验、情感体验紧密相连,还深受物质环境和社会背景的影响。换言之,抽象符号的认知加工离不开个体的感知、运动和情感体验,也离不开所处情境,认知需要具身化、接地化,这便是具身认知的核心观点。认知如何具身?马洪和卡拉马扎指出,具

2026-04-25 14:16:41  |  20 阅读

AI大模型实现“肌肉记忆”:Token使用量降低超七成,决策更精准

编者按:AGI时代正加速来临,智能系统从“工具”向“伙伴”转变,同时带来了许多亟待解决的核心问题:如何保证智能系统安全、可信、可控?如何在智能体之间(A2A)建立安全可信的交易支付体系?如何持续提升模型Token效率,让模型又快又准,加速智能体规模化应用?又如何通过高质量数据不断优化大模型性能?面对这些关键挑战,蚂蚁数科将携手高校推出系列技术研究《In Tokens We Trust》,聚焦上述前沿议题,分享我们在探索中的思考与实践。今天带来专题的第二篇:蚂蚁数科与中国科学技术大学的联合研究成果:让AI大

2026-04-24 19:50:21  |  16 阅读
以阅读为桥,家乡与世界相遇

以阅读为桥,家乡与世界相遇

很荣幸能来到江西参与这场关于阅读的盛会。幼年时期,我常在继父讲述的故事里,一次次神游至江西的九江、柴桑,那片三国风云激荡的土地。继父并不识字,他只是村里的一名马车夫,时常赶着车离开村子,在县城或省城的车马店中听人说书。每次长途归来,他都满载着一肚子的传奇。在那些夜晚,村里的许多乡亲会聚到我们家昏黄的油灯下,听我继父说书。他讲《杨家将》,说《薛仁贵征西》,但讲得最多的还是《三国演义》。我在他的讲述中,听到了诸葛亮舌战群儒的精彩,听到了周瑜打黄盖那份默契的苦肉计,听到了草船借箭的智慧,以及那些英雄故事里奔腾不

2026-04-24 13:16:54  |  71 阅读

AI时代:构建个人知识生产体系与外脑逻辑

今天我们探讨一下个人效率的核心议题:个体知识信息的采集、加工与运用机制。每个人构建知识体系、保存资讯的方法各异,有人借助各式笔记软件进行记载,有人致力于搭建高效的效能系统,但追根溯源,我们都离不开一个稳固的外部储存空间,用以补偿人脑记忆力的固有不足。人类的能力与记忆,从根本上可划分为两个维度。其一是内隐记忆,又称机能记忆、运动记忆或程序记忆。这类记忆植根于身体反应与行为模式中,是无需主动回想即可运转的基础能力,构成了个人核心竞争力的关键部分。其二是事实记忆,即知识储备、内容记忆。传统教育体系多以知识记忆为

2026-04-23 09:23:06  |  34 阅读
《密探》:银幕如何追寻历史与记忆

《密探》:银幕如何追寻历史与记忆

《密探》导演门多萨以浓烈的色彩画面,将观众带入一个暴力、死亡、腐败与纵情享乐交织的魔幻天地。 北京国际电影节的"戛纳系"参展影片早早售罄,年轻观众在社交网络踊跃地打卡、晒票根,至于这是"文艺过节"的社交货币,还是对艺术电影的日常需求,就耐人寻味得很。影展"秒空"的热门电影进入院线会怎样?与北影节的抢票热闹形成戏剧性对照,获得去年戛纳影展最佳导演奖的巴西电影《密探》公映四周,票房尚未冲过100万元。 《密探》绝非沉闷的长镜头艺术电影。 影片开篇即以紧张刺激的场景抓住观众:男子驾驶明黄色甲壳虫轿车驶入荒郊加油

2026-04-23 09:01:53  |  28 阅读

《从零构建AI智能体》书籍解析

篇幅达2340字,预估阅读时长约12分钟本书由Manning出版社于2026年推出MEAP版本,涵盖《从零构建AI智能体》前7章全部核心内容,体系化呈现基础定义→LLM中枢→工具调用→ReAct智能体→RAG知识库→记忆机制→规划反思完整链路,全程围绕Python、GAIA基准、上下文工程三大主线展开。作为全书的开篇导论,本书摒弃直接套用LangGraph/CrewAI等黑盒框架的理念,倡导从底层自建智能体,唯有洞悉每个模块的运作原理,方能实现真正的调试与优化。智能体本质上即具备自主思考、工具调用、循环执

2026-04-22 21:30:05  |  25 阅读

状态连续性制胜:人大AiScientist实现23小时74轮研究突破

新智元讯自动化科研正迅速崛起为人工智能核心赛道之一。在机器学习领域,已有诸多系统能够参与构思生成、文献综述、定向实验、学术写作等环节。无论是从论文到代码,还是从实验到分析,AI赋能研究的范畴都在持续延展。AiScientist的突破点,是在这些既有成果之上,进一步瞄准一个更具实践性、也更贴近真实科研场景的命题:长程ML研究工程。在此场景下,系统并非仅完成某一孤立环节,而是要从论文或研究目标出发,连贯处理环境搭建、依赖管理、资源调用、代码实现、实验运行、结果比对、错误溯源与反复修正。这既涉及各阶段自身的技术

2026-04-20 12:13:00  |  34 阅读

AI赋能教育:解析本质、意义与策略

是什么目前市面上常见的免费AI应用,归根结底是一个高度集中的信息检索工具。它擅长从海量数据中筛选出概率最高的答案。虽然AI能解答“是什么”,但它无法协助学习者构建起知识点之间的内在联系。所以,与其说是能理解学科逻辑的教师,不如说它更像是一个反应快、学识广的智能助手。为什么鉴于AI的上述特点,学生的基础知识积累与学科架构显得尤为关键。教育心理学早已证实,深度的思考与迁移能力离不开稳固的长时记忆——若缺乏事实性知识的支撑,批判性思维便沦为空谈。此外,学科框架是学生辨别信息、提出疑问的“导航图”,若缺失这张图,

2026-04-20 02:05:32  |  53 阅读

智能体技术深度解析

智能体由大语言模型(核心思维)、规划能力(任务分解)、工具调用(行动执行)和记忆模块(信息存储)四大要素构成。大语言模型(大脑):承担着主要推理职责,包括解读用户需求、产出文本内容以及执行逻辑分析。规划功能:可将模糊的高阶目标(例如"组织一次技术分享会")转化为具体可实施的操作序列。记忆系统:包含短期记忆(追踪当前对话)与长期记忆(保存专业知识体系)两个层面。工具使用能力:使智能体能够按需检索网络信息、查询数据库或执行编程任务。常规大模型仅提供单次回应,而智能体的精髓在于持续迭代优化。ReAct框架(思考

2026-04-19 23:47:41  |  25 阅读

越用越聪明的AI助手:Hermes Agent凭什么两月收获6万星标

> 2026年2月25日,名为 Hermes Agent 的开源项目在 GitHub 低调发布。仅一个多月时间,便斩获逾 6 万星标,迅速跻身 AI 智能体赛道的热门项目。或许你体验过 ChatGPT、Claude,或尝试过各类 AI 编程助手。然而它们普遍存在一个短板——每轮对话都需重新开始。昨日刚告知"项目基于 Python 3.13",今日便忘得一干二净;上周刚生成的部署脚本,本周又需重新解析。Hermes Agent 正是为解决这一痛点而生。---它有何独特之处?Hermes Agent 是

2026-04-19 00:20:23  |  14 阅读

郑庆华院士:借鉴人脑记忆机制,开辟AI智能新路径

我们致力于提升机器智能水平,使其如同人类般拥有因果推断与逻辑推演能力,尤其要在低算力环境下实现小样本持续学习,支撑起具备强大推理能力的新型AI系统。近日,在第七届人民网内容科技论坛上,中国工程院院士、同济大学党委书记郑庆华发表主旨演讲,提出“脑认知启发的机器记忆智能”新方向,倡导跳出数据驱动大模型的路径依赖,探索低算力、小样本、强推理的人工智能新路径,为人工智能与脑科学深度融合提供全新思路。他追溯道,自1956年人工智能概念诞生以来,其演进脉络基本遵循从计算智能到感知智能,再向认知智能迈进的路径,展望未来

2026-04-18 06:18:07  |  19 阅读

AI双雄同日对决:OpenAI与Anthropic走向分岔路

人工智能领域迎来了一场巅峰对决:OpenAI 推出 Codex 重大升级,Anthropic 发布 Claude Opus 4.7两大重磅产品同日亮相,如此戏剧性的场面,堪称罕见。先来看看 OpenAI 的这次动作。他们将 Codex 打造成了真正的 AI 协作伙伴——不仅辅助编写代码,更能操控整台计算机。Codex 新增了后台计算机操控(Background Computer Use)能力。简单来说:它能像人类一样,查看屏幕、移动光标、点击按键、输入文字。这代表着什么?多个 AI 智能体可在你的 Mac

2026-04-17 06:51:21  |  24 阅读

AI记忆力首超人类:幻觉率降至0.5%,长对话告别瞎编

若AI不再拥有“金鱼脑”,能回忆起三天前我们聊过的每一个细节,这究竟预示着什么?近期,一项开创性的研究发现,新型AI模型在长对话记忆测试中,核心事实的幻觉率已降至惊人的0.5%,并在特定指标上首次超越了人类平均水平。这不仅仅意味着AI能进行更流畅、更精准的深度交流,更有可能彻底重塑客服、教育、医疗咨询及个人助理等行业的交互模式。本文将深入剖析这一技术突破的内核、运作机理,以及它对未来的深远影响。你是否有过这样的经历:正与某个AI助手聊得火热,从工作谈到生活,从电影聊到哲学,可当你兴致勃勃地提起“我们昨天讨

2026-04-17 02:18:58  |  14 阅读

AI动态十连发:浏览器变身任务中枢,智能穿戴杀入生活场景

1. 谷歌浏览器集成AI技能,化身任务处理中枢谷歌为Chrome新增AI技能模块,允许用户在Gemini侧边栏激活预设或自定义命令,一键完成视频解析、菜谱研究和产品比价等操作。观察:此次升级意味着浏览器角色迎来质变——由传统的内容展示平台进化为任务执行枢纽。以往用户需在多页面间手动检索,如今可在浏览器内直接完成轻量级工作流。这不仅极大简化了普通用户的AI操作难度,也让浏览器在人工智能时代重新占据流量分发的战略要地。2. OpenAI推出网络防御专用模型,AI安全对抗升级OpenAI发布专用于防御性网络安全

2026-04-16 12:28:34  |  15 阅读