标签

六项AI国标获批立项,上海实验室加速构建评测标准网络

近期,上海人工智能实验室(上海AI实验室)主导的六项国家级标准成功获得立项批准,涉及大模型、科学智能、AI安全、具身智能等尖端技术方向。借助长期积累的产学研协同优势,该实验室已建立起一套领域完备、层次分明、全流程贯通的AI评测标准体系。通过开发主客观结合的综合性评测框架,实验室着力打造兼顾技术指标与实际应用的评价模式,为推进“人工智能+”战略提供坚实保障。同时,由上海AI实验室引领的多项关键人工智能标准正在有序推动立项与制定进程,其中涵盖IEEE首项科学智能领域国际标准。基于WG9组长单位的职能,实验室正

2026-07-06 23:48:21  |  10 阅读
腾讯混元Hy3正式亮相

腾讯混元Hy3正式亮相

新浪科技讯 7月6日下午消息,腾讯混元Hy3 正式发布。相比preview版本,它展现出显著强于同尺寸模型且比肩(参数规模2—5倍的)旗舰模型的智能水平,定价进一步降低,总体稳定性和性价比大幅提升。Hy3已在WorkBuddy/CodeBuddy、元宝、Marvis、ima等多个业务接入,API已在腾讯云TokenHub上线,多个海外API平台也将陆续接入。 据介绍,Hy3是一个快慢思考融合的模型,采用 MoE 架构,总参数 295B、激活参数 21B,支持 256K 上下文长度。4月23日发布的Hy3

2026-07-06 22:54:29  |  8 阅读

AI赛道的分水岭时刻

豆包和通义千问的智能体功能即将停止服务。7月15日,统一关闭。两大头部平台,同一天,同一功能,同时按下停止键。这种步调一致的操作,在互联网行业并不常见。更加引人关注的是,7月15日恰逢《人工智能拟人化互动服务管理暂行办法》正式生效之日。时间节点把握得如此精准,内在原因不言自明。先说具体的关闭方式。豆包的公告写得很明确:7月15日起,无法创建新的智能体,现有的也无法使用。用户数据保留到10月15日,之后全部清除。通义千问的安排更紧凑——7月10日先取消拟人化互动类和用户自建类,7月15日所有智能体功能全面下

2026-07-06 22:46:02  |  20 阅读

中国人工智能核心产业跨越八千亿大关

2026年7月2日,工业和信息化部发布最新统计:今年上半年,我国人工智能核心产业规模攀升至8230亿元,同比增长28.6%。这一数字标志着中国AI产业正式越过“八千亿里程碑”。同日还公布了两项关键指标:大模型备案总数达197款,生成式AI服务用户量突破5.2亿。8230亿元意味着什么?这大约相当于一个中等省份的年度财政收入。但更引人注目的是增长速度——28.6%是在2025年同期高基础之上的扩张。回顾往年,2024年中国AI核心产业规模约5800亿,2025年增至6400亿,而2026年仅用半年就实现了以

2026-07-06 22:27:24  |  20 阅读

AI驱动科研提效:智能体构建实战指南

国家层面持续强化人工智能与科研融合的政策布局。‘十五五’规划明确提出深化‘人工智能+’行动,推动AI与科研深度协同,各地也陆续推出专项支持政策。这标志着我国科研模式已从依赖传统要素与算力扩张,全面迈入智能驱动、效能跃升的新阶段。为帮助科研人员掌握AI核心能力、构建个性化智能科研体系,中国科学院人才交流开发中心拟于2026年7月、8月、9月举办三期‘AI赋能科研实践与智能体构建’高级研修班,特邀中科院院所及顶尖高校专家,讲授AI在科研全流程中的落地技能。具体安排如下:一、主题与内容(一)大模型基础原理与选型

2026-07-06 22:05:36  |  24 阅读

AI Agent技术演进与产业落地全景分析

2023—2024年行业竞争焦点集中在通用大模型参数规模与生成能力,2025年智能体技术完成技术验证与场景试点,2026年则正式迈入规模化落地爆发阶段。AI智能体彻底颠覆了传统大模型“被动问答、单次生成”的局限,凭借自主规划、长期记忆、工具调用、自我反思、多智能体协作五大核心能力,实现从“对话工具”到“自主执行主体”的范式跃迁,被全球科技企业与科研机构公认为人工智能产业的下一个确定性主流发展方向。本文系统梳理AI智能体技术演进脉络与底层核心架构,结合多领域真实落地案例,深入剖析当前技术瓶颈与商业化痛点,研

2026-07-06 21:47:41  |  16 阅读
美团发布LongCat-2.0开源版本 国产芯片企业纷纷完成适配

美团发布LongCat-2.0开源版本 国产芯片企业纷纷完成适配

新浪科技讯 7月6日晚间消息,美团宣布正式开源LongCat-2.0全部模型权重、推理引擎与核心技术文档。同日,华为昇腾、摩尔线程(635.510, -8.30, -1.29%)、沐曦股份(731.000, -7.38, -1.00%)等国产芯片厂商,集体宣布完成对该模型的推理适配工作。 据介绍,LongCat-2.0是首个完全依靠国产算力完成训练和推理全流程的万亿参数大模型,其Agent、Coding等核心能力跻身全球顶尖大模型行列。

2026-07-06 21:35:06  |  14 阅读

AI入门指南:只需三句话,揭开人工智能的神秘面纱

“AI太复杂了,我根本搞不懂”——这是很多人面对人工智能时的第一反应。但实际上,AI的本质一点都不神秘。你不需要懂编程,不需要懂数学,甚至不需要懂技术。这一讲,我们用三句话、几个比喻,把AI的核心逻辑全部展示给你。很多人觉得AI高深莫测,一听到“人工智能”四个字就觉得跟自己没关系。但事实并非如此。AI的本质可以用三句话来概括:Artificial Intelligence,拆开看——Artificial(人工的、人造的)和Intelligence(智能)。AI就是用人为的手段,创造出来的智能。它不是天生的

2026-07-06 21:26:56  |  13 阅读

人工智能学习路线与知识架构全景图

人工智能学习系列,涵盖7大核心模块随时随地快速掌握人工智能相关知识人工智能的知识架构并非单一路径,而是一幅分层地图。需先审视技术成熟度,再分析依赖关系、并列关系、演进路径与融合趋势,方能判断哪些内容可直接落地应用,哪些仍需持续跟踪验证。基础层涵盖数学基础与数据工程。数学提供表示、优化、不确定性及信息度量能力;数据工程决定训练素材的质量;隐私保护则决定数据能否合规地被系统使用。传统机器学习依然是结构化数据、可解释场景及中小规模业务的主力。其核心并非追求最大模型,而是实现特征、算法、任务与指标的精准匹配。深度

2026-07-06 20:45:23  |  12 阅读

人工智能探索笔记|大模型究竟为何物?

轻点关注加入我们开篇近两年来,无论你是金融从业者、材料研究员,还是气象预报专家,甚至只是闲暇时浏览手机,都难免被“大模型”这个词汇频频冲击。科技巨头们狂热地将数千亿资金倾注于数据中心。采购芯片、铺设电网,仿佛要将全球服务器连为一体。有人戏言,如今大模型每升级一代,地球的碳排放就得剧烈波动三次。这不禁令人困惑。以往提及AI,不外乎人脸识别、刷脸支付,或手机相册自动归类。为何转瞬间,这些话题被搁置,满耳尽是“大模型”?大模型到底是何种庞然大物?我们常听到的Token,又在故弄什么玄虚?今日我们不涉艰深学术论文

2026-07-06 20:06:14  |  22 阅读

AI互动服务新规揭露伪AI测评企业真相?

‌当前机器人未实现广泛部署,核心原因是具身智能大模型仍不完善。‌若一家自称AI测评的企业,其人才测评类智能体完全未受影响,这是否暗示他们之前从事的根本不是生成式人工智能呢?<上海职配的官网>因为《办法》的监管焦点是“拟人化互动”和“情感误导”。如果一个智能体外观像表格,运作似计算器,用户甚至察觉不到它是“智能体”,监管机构也就难以将其认定为“高风险情感类互动服务”。这是深度合规后的产品化方案。它们将大模型的能力“限制”在极窄的专业领域内,杜绝了任何产生“情感幻觉”的可能性。

2026-07-06 19:40:12  |  16 阅读

Nature Medicine发表:AI模型提升癌症免疫治疗预测准确率

被称为免疫检查点抑制剂(ICIs)的癌症免疫治疗药物,对于病患而言宛如“神药”,不仅能治愈部分癌症,还能让某些绝症变为可控的慢性疾病。然而,此类药物并非对所有人均有效,且疗效差异背后的机制尚不明确。这一认知缺口严重影响了患者的预后评估、临床试验的招募以及新疗法的研发进程。哈佛医学院及其团队研发出一种名为COMPASS的新型AI模型,旨在更精准地预测患者对ICIs的反应。基于既往病例数据,该模型的预测准确率比现有最佳方法提升了8.5%。它依据肿瘤基因活性进行研判,并提供了可解释的原理依据。若未来临床试验证实

2026-07-06 14:49:25  |  59 阅读

一文读懂AI Agent:从核心原理到关键组件

当你向智能体下达指令:"帮我提取上个月的销售数据,对比市场同类产品,生成分析报告并抄送团队"。十分钟后,智能体已完成:连接数据库、执行SQL分析、联网搜索竞品、绘制图表、生成图文报告,并等待人工确认发送。如今,智能体(AI Agent)已能替代人工完成实际任务。本文将解析其核心机制与构成要素。简言之,AI Agent是以大语言模型(LLM)为"大脑",能自主感知环境、决策推理、调用工具并循环执行直至达成目标的系统。区别在于行动力。聊天机器人止步于文字输出,Agent则能搜索

2026-07-06 14:21:11  |  16 阅读

AI技术日报:2026年7月5日行业动态速览

Fable 5 与 GPT 5.5 的性能较量持续升温,业界普遍认为 Fable 5 在复杂应用构建、游戏原型开发以及长周期项目上更具优势,但也有人认为这种差异源于任务特性、上下文配置和运行环境。与此同时,Fable 5 将于 7 月 7 日从 ChatGPT 订阅体系中剥离,转为按量付费模式,这意味着它将从"随手可试"的订阅服务转变为需要精打细算的生产工具。这一变化的核心不在于定价,而在于模型定位的转变:当模型能够持续输出可运行的游戏、面试 Agent 和多模态交互项目时,用户对它的期望已从"答疑解惑"

2026-07-06 14:19:56  |  15 阅读

AI简报:2026年7月6日

MiniMax推出新一代模型M3,其核心变化在于不再单纯强调Benchmark排名,而是着重展示模型在真实工作场景中的任务完成能力,例如SWE Bench、BrowserComp、OSWorld等评测。这表明模型评价标准已从“知识考试”转向“岗位考核”,产品叙事也从Token收入转向Workflow收入。MiniMax试图将自身定位为企业工作入口,与浏览器、IDE、ERP等软件竞争,强调模型成为基础设施,工作流成为产品。壁仞科技在港交所发布公告,按每股46.2港元配售1.53亿股新H股,募资总额约70.6

2026-07-06 14:06:09  |  25 阅读