标签

SkillOpt-Lite:一行指令实现智能体高效自我进化

2026年07月09日星期四SkillOpt-Lite: 通过简单指令实现更优更快的智能体自我进化🤗 17针对现有智能体技能优化方法流程复杂的问题,本文提出一种基于零阶优化的最小可行框架SkillOpt-Lite。其核心是三个确保收敛与泛化的原则:基于文件系统的轨迹探索、共识属性挖掘和独立验证门控。该方法不仅加速收敛,且在多个模型上超越完整版SkillOpt,例如将GPT-5.4-nano的性能提升至超越标准SkillOpt优化的GPT-5.4。该框架已集成至VSCode Copilot等生产环境,开发者

2026-07-09 17:17:20  |  13 阅读

AI应用前沿|Tool-Genesis:驱动自进化语言智能体工具创建的任务导向基准 (1/20篇) · 7月6日

2026年07月06日星期一Tool-Genesis: A Task-Driven Tool Creation Benchmark for Self-Evolving Language Agent自进化语言智能体领域正快速推进,然而其依据任务需求进行工具构建、适配与维护的能力尚缺乏系统性的评估手段。当前主流基准多受制于预先设定的规范框架,制约了系统的可拓展性与自主进化空间。本研究推出诊断型基准Tool-Genesis,致力于从接口规范性、功能准确性及下游实用价值等多元视角对智能体能力进行量化评估。该基准检

2026-07-07 04:36:43  |  14 阅读

马仁志教授论AI智能体:从辅助工具到自主科研伙伴的进化

近期,英国皇家化学会期刊Nanoscale与Nanoscale Advances的副主编马仁志教授,在Nanoscale Horizons上刊文,深入分析了人工智能智能体在材料与纳米科学领域,如何从辅助性工具演变为自主研究伙伴。该文现已开放免费获取,欢迎读者向下浏览。马仁志教授是一位享誉国际的材料科学专家,长期担任日本国立物质材料研究机构(NIMS)材料纳米构造国际中心(MANA)的主席研究员及主干研究员。他的研究重点集中在二维纳米材料、电化学储能和催化材料等方向。https://doi.org/10.1

2026-06-27 09:47:54  |  26 阅读

AI圈今日三件大事:顶尖人才转向安全阵营、阿里开源向量数据库、DeepSeek实现AI自主研究

今日 AI 领域传来三条重要动态:AlphaFold 项目负责人 John Jumper 结束在 Google DeepMind 近九年的工作生涯,宣布加入 Anthropic,顶尖人才持续向安全导向型公司聚集;阿里正式开源其内部向量数据库 Zvec,仅需一条 pip 命令即可免费使用,功能对标 Pinecone 每月 70 美元的服务;DeepSeek 研究团队成员 Deli Chen 开源 AutoResearch 框架,首次实现 AI 完全自主完成 285B 参数模型的强化学习研究全流程。下面为大家

2026-06-20 08:09:46  |  18 阅读

2025年度AI智能体全景洞察:技术突破与安全防护深度解析

2026年04月22日星期三The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems面对AI智能体生态体系复杂多变、发展迅猛且文档标准不一的现状,研究团队构建了2025年度AI智能体发展指数。该指数通过整合公开资料及与开发者的直接沟通,系统梳理了30个领先AI智能体的研发背景、架构设计、功能边界、应用生态及安全防护机制。分析发现,各厂商在信息披露方面存在明显差异,尤其在

2026-04-22 15:15:57  |  8 阅读

突破医学AI研究局限

近年来,能够自主生成科学假设、开展实验并起草论文的手系统已成为加速科学发现的一种极具前景的范式。然而,现有的“人工智能科学家(AI Scientists)”在很大程度上仍属于领域无关型(domain-agnostic),这限制了它们在临床医学中的应用,因为医学研究要求以临床证据为基础,并涉及专门的数据模态。在本研究中,我们推出了Medical AI Scientist,这是首个专为临床自主研究定制的自主研究框架。该框架通过一种临床医生-工程师协同推理机制(clinician-engineer co-rea

2026-04-02 11:08:26  |  18 阅读