标签

AI为何能输出复杂推理过程?原理大揭秘

AI 原理系列当我们使用AI时,若开启深度思考模式,模型会展示一连串的思考轨迹涵盖拆解难题、逻辑推导,甚至自我纠错比如像 “等等,感觉不对,我重新思考一下”这些繁复的逻辑推导究竟是如何实现的?首先,AI大模型的训练主要分为三个阶段预训练阶段监督微调阶段强化学习阶段别担心,这三个概念听起来很深奥,但我会尽量通俗地解释,让你了解核心逻辑让我们开始正题首先,AI大模型在完成预训练后—— 就从 初始模型 升级为 基座模型此时通过海量数据的洗礼,人类世界的常识与物理法则已被内化于模型内部具体是如何内化的?本质上就是

2026-07-21 02:46:04  |  7 阅读

AI为何要先思考再回答

为什么让AI"先思考再回答",答案质量会出现明显差距?思维链 = 引导AI一步步推理后再给出答案不直接问结果,而是让AI把"思考过程"写出来,再得出结论。大模型本质是"猜词器"——你问一个问题,它直接猜最可能的"答案词"。但复杂问题没法直接猜,需要先推理中间步骤。思维链就是让AI把推理过程"写出来"再给答案,效果远好于直接回答。场景举例:合同条款风险评估❌直接问:"这份施工合同有风险吗?"

2026-07-20 14:15:01  |  5 阅读

爱芯元智发布元曦系列大算力新品,推动边缘AI规模化落地

上海,中国——2026世界人工智能大会(WAIC 2026)正式启幕,全球领先的AI推理系统芯片供应商爱芯元智(0600.HK)携完整AI生态重磅亮相。本次参展,爱芯元智以多元应用场景全景呈现AI计算规模化落地成果,集中展出全线AI算力产品矩阵,并首度揭秘爱芯元曦AI推理系列新品。本次展会,爱芯元智集中展示基于自研边缘AI算力底座的全行业落地成果。公司以高能效AI芯片及边、端侧AI技术为核心支撑,赋能生态伙伴打造多形态智能化终端产品,覆盖智慧工业、智慧教育、商业办公、零售民生、具身智能等多元场景,充分展现

2026-07-18 19:04:07  |  12 阅读

AI推理爆发:PCDN边缘计算的新机遇与合规挑战

近两年,AI领域的焦点始终集中在“训练”环节——科技巨头们大量囤积GPU,构建超大规模数据中心。据行业研究机构Canalys最新数据,2025年全球AI基础设施支出已超3000亿美元,其中训练算力占据主导地位。然而,2026年的发展轨迹正悄然转变。随着大模型从“可用”迈向“好用”,推理场景逐渐超越训练场景。Token日均调用量从2024年初的1000亿激增至如今的140万亿,两年内增长逾千倍。更为关键的是,推理算力占比已超70%,单次推理请求的算力消耗是训练的5至10倍——这意味着,当模型真正落地应用时,

2026-07-16 02:17:55  |  29 阅读

人工智能推理效能评估解析

AI推理评估旨在检验模型与硬件间的协同效率,直接关系到智能终端的工作表现。其运作机制为载入模型后,借助GPU、NPU执行张量运算和特征抽取,最终呈现结果。评估需兼顾运算能力、响应延迟、处理吞吐和精确度。TOPS作为推理算力的专属度量,1 TOPS意味着每秒可执行一万亿次计算,常用于衡量INT8精度下边缘芯片的运算实力。测试一般遵循MLPerf行业规范,设定好精度与数据批量,运行基准模型,计算出实际算力、算力利用率、推理延迟以及每秒产出token的速率。芯片宣称的峰值TOPS数值高并非代表真实表现优异,若硬

2026-07-13 11:55:17  |  21 阅读

AI芯片研发与平台升级同步推进:行业最新动态汇总

6. 国际媒体披露:DeepSeek正研发专用推理处理器,市场反应明显据海外媒体7月8日报道,DeepSeek正在打造自主AI推理芯片,旨在减少对英伟达和华为产品的依赖。这款芯片聚焦推理运算,不涵盖模型训练环节,项目仍处于初期开发阶段。DeepSeek正与多家芯片设计公司、代工企业及存储供应商接洽,同时大力招募芯片工程人才。此前,DeepSeek利用H800成功训练出R1模型,在美国出口限制导致供应链中断后转向华为昇腾平台,已推出适配昇腾的V4版本。此番自主研发芯片的策略与OpenAI的Jalapeno、

2026-07-10 17:44:57  |  11 阅读

AI观察 | 本土算力业绩爆发:从昇腾集群到云服务转折

📅 2026年7月9日 · 星期四浪潮信息中期净利润预增226%-288%,深信服20CM涨停,国资云板块领涨——本土算力产业链正从"概念炒作"迈向"业绩兑现"的关键转折点。在全球科技股同步承压、韩股步入熊市的背景下,A股本土算力板块逆势崛起。7月8日,云计算概念大爆发,深信服、网宿科技等20CM涨停,浪潮信息一字涨停,封单超70万手。消息面上,2026世界人工智能大会(WAIC)即将于7月17日在上海举行,昇腾旗下Atlas 950 SuperPoD超节点将重磅首展。市场对本土算力的关注从"有没有"迅速

2026-07-09 07:56:35  |  22 阅读

2026年AI算力新周期:Token工厂模式与基础设施变革

△ 点击上方关注,加星标置顶本号即时掌握锦麟资本最新动态进入2026年,全球人工智能产业全面迈入以“具身智能”和“群智智能体”为核心的应用爆发期,AI算力需求结构发生根本性逆转——大模型大规模训练的算力红利逐步向长尾、高并发的推理算力池转移。在传统的算力租赁模式下,数据中心运营商扮演的是类似“数据地产商”的角色。通过大量采购英伟达、AMD或大厂自主研发的专用芯片,以固定时租(如单卡小时数)将硬件资源整块打包给大模型厂商。传统模式的弊端:基础设施厂商不承担模型研发风险,但也彻底绝缘了下游应用爆发带来的溢价红

2026-07-09 06:17:30  |  13 阅读
英伟达与d-Matrix达成合作:融合架构赋能AI推理性能跃升

英伟达与d-Matrix达成合作:融合架构赋能AI推理性能跃升

【科技媒体7月8日报道】据海外媒体The Information于7日披露,全球领先的GPU芯片厂商NVIDIA正与定制芯片新锐d-Matrix展开深度合作,共同构建融合型算力平台,旨在高效支撑AI模型的部署与运行。 据悉,d-Matrix在当日发布的官方声明中透露,云服务提供商Parasail通过整合NVIDIA Hopper/Blackwell系列GPU与d-Matrix自研的Corsair ASIC芯片,成功实现了令牌产出效率的十倍增长。 这款Corsair芯片基于数字存内计算架构打造,采用台积电先

2026-07-09 06:16:09  |  47 阅读

DeepSeek布局自研AI推理芯片

据路透社援引知情人士透露,DeepSeek正着手研发自有AI推理芯片,旨在减少对英伟达芯片的依赖。该芯片专为推理场景设计,即模型训练完成后生成响应的计算过程,而非用于训练新模型。若项目顺利推进,DeepSeek将正式进入半导体设计领域。三位知情人士称,该项目尚处初期,公司已开始接触外部合作伙伴,并与芯片设计、晶圆代工及存储厂商进行初步沟通。其中一人表示,相关工作约一年前启动。另有两人指出,近几个月DeepSeek显著增加了芯片设计工程师的招聘,但招聘采取隐蔽方式进行,未在公开平台发布。自研AI芯片难度巨大

2026-07-08 19:37:58  |  11 阅读

HBM之父金正浩:AI核心在内存,存储重塑算力格局

在人工智能迅猛发展的浪潮中,行业长期以来将GPU奉为算力的绝对核心。然而,随着AI技术从训练阶段跨越至推理及智能体(Agentic AI)时代,一场关于计算架构的深刻变革正在悄然上演。7月6日传来消息,被尊称为“HBM之父”的韩国科学技术院(KAIST)电气系教授金正浩在近期受访时强调,AI的核心竞争力正由GPU向内存转移。他断言,AI的本质在于内存,在当下的AI推理环节,GPU真正用于计算的时间仅占10%到30%。这一观点不仅揭示了当前AI硬件的底层瓶颈,更预示着未来存储芯片在AI应用领域将掀起颠覆性的

2026-07-07 11:20:39  |  21 阅读

智能建筑新突破:PKPM实现户型图自动识别与结构设计

智能建筑新突破:PKPM实现户型图自动识别与结构设计不久前我向 PKPM 上传了一张户型图,它直接生成了一套完整的梁柱配筋图纸。我停顿了好几秒。不是因为出现差错,而是结果过于精准。以往需要三人团队忙碌两周的任务,如今一杯咖啡的功夫就完成了。我核查了几个关键节点的配筋情况,与手工计算的偏差在 3% 以内。我果断又验证了一次。这次特意选择了异形柱、转角窗、飘窗上翻梁——这些都是资深工程师认为“AI 无法应对”的难题。它不仅全部识别,还把连梁的刚度折减、边缘构件的箍筋加密区都配置妥当。我深感震惊。这已超越辅助工

2026-07-03 02:36:03  |  13 阅读

AI推理赛道杀出黑马,挑战英伟达霸主地位

就在刚刚,又一家AI芯片企业正式“出山”。“我们即将走出隐身状态。”美西时间6月30日,AI芯片新秀 Etched 在X平台宣布,公司已完成首颗A0流片,并建成了首批整机机柜(Frontier Inference Clusters)。不仅如此,产品已累计签订超过10亿美元客户合同,融资总额达到8亿美元,首批产品将于今年夏季交付。Etched还透露,早期客户测试表明,其系统在推理任务上的吞吐量、延迟和能效已处于行业领先水平。AI芯片行业几乎每天都有新公司诞生,Etched之所以引发关注,是因为它选择了一条与

2026-07-01 10:37:52  |  21 阅读

Etched斩获8亿美金投资,AI推理芯片竞争加剧

人工智能芯片初创企业Etched于本周二宣告脱离隐匿状态,公布已筹措总额达8亿美元的资金,同时斩获逾10亿美元的客户订单。该企业预计在今年夏天向客户交付其机架级别的推理系统。 在上述融资中,最近一轮发生于去年12月的5亿美元募资,使其投后估值攀升至50亿美元。此轮融资由Stripes领投,彼得·蒂尔、Positive Sum及Ribbit Capital等机构与个人跟投。此外,量化交易巨头Jane Street主导了一轮先前未曾披露的融资,对Etched的累计注资额已突破1亿美元大关。 Etched由哈佛

2026-07-01 08:17:38  |  14 阅读

AI推理遇微秒瓶颈?Alice&Bob首创“解耦AI”架构破局

量子计算的强项在于攻克传统计算设备无能为力的难题。然而,量子态极易受干扰,会在瞬息之间发生退相干现象。业界普遍认为,容错量子计算是释放量子潜力的最佳途径,但代价极其高昂。往往需要上千个物理量子比特,才能构筑出一个逻辑量子比特。相比之下,经典计算的纠错冗余度仅需12.5%。Alice&Bob研发的猫量子比特借助玻色编码,从硬件层面遏制了比特翻转失误,从而将纠错开销呈指数级削减。与其他技术路线相比,其物理量子比特的需求量骤降了200倍之多。然而,节约物理比特的代价,是让控制回路承受了巨大压力。猫量子比

2026-06-29 19:22:37  |  18 阅读