标签

官方认可!网宿边缘AI网关脱颖而出,CDN开启Token分发新阶段

官方认可!网宿边缘AI网关脱颖而出,CDN开启Token分发新阶段权威测试:三大指标显著领先行业标准9月3日,中国信息通信研究院发布第三批"词元(Token)服务能力提升计划"评测结果,网宿科技依托边缘AI网关顺利入围。实测数据表明,三项关键指标均显著超越行业基准:每秒Token处理量(TPS)较标准高出95%,首个Token响应延迟降低65%,接口调用成功率实现100%的顶级水平。这并非企业单方面的性能宣传,而是由国家权威机构按季度动态更新的统一性能标准。评测结果表明,网宿边缘AI网关已具备承载AI推理

2026-09-05 09:14:50  |  3 阅读

Astra震撼数学界:AI首次完成可机器验证的形式化证明

8月末,OpenAI抛出一颗重磅炸弹:其全新模型Astra在纯粹数学范畴内斩获十项重大进展,并且每一项均配有以Lean形式化语言撰写、机器可自动核验的完整推导过程。与此同时,一份厚达249页的技术文档同步发布,供任何人下载审阅。说白了就是:AI不仅解出了数学题,还把整个求解流程封装成机器能自动校验的证明文件——正误与否,不由AI说了算,机器来判。这一事件的意义,远远被外界轻视了。不少人对于"AI做数学题"的认知还固化在:让ChatGPT算一道小学竞赛题,它煞有介事地给出错误答案。那顶多叫生成,谈不上证明。

2026-08-29 14:25:16  |  19 阅读

投资课堂 | AI推理芯片究竟是什么?

推理芯片(Inference Chip)是一种专为驱动AI模型运行而定制的处理器,主要在模型完成训练之后承担实时响应用户输入、产出结果的任务(即所谓的"推理"环节)。与一味追求极致算力的"训练芯片"相比,推理芯片更看重低时延、低功耗、高能效比以及低成本1. 核心职能与运行机制职能:把已经训练完毕的AI模型落地到真实业务场景中,应对用户的实时调用(包括对话、图像识别、语音翻译等),完成即时数据处理与智能判断。机制:模型权重已经锁定,不再需要反向传播与梯度计算,根本理念是"效率至上",借助对计算精度与硬件结构

2026-08-28 20:51:05  |  6 阅读
OpenAI自研AI芯片测试结果:响应效率与能耗比均领先英伟达GB300

OpenAI自研AI芯片测试结果:响应效率与能耗比均领先英伟达GB300

财联社8月26日报道(编辑 赵昊)OpenAI宣称其最新研发的"Jalapeno"芯片在对比测试中表现优异,全面超越了英伟达现有的产品系列,标志着该公司在自研AI处理器领域取得了重要进展。OpenAI芯片部门主管Richard Ho在专访中透露,这款芯片被拿来与英伟达GB300直接较量,后者被视为当下业内最顶尖的解决方案。测试结果显示,Jalapeno在两项关键指标上胜出:单位能耗下可承载的AI运算量,以及响应所需的时间。此次OpenAI公开展示Jalapeno性能时,采用了自家体量较小的开源模型GPT‑

2026-08-26 19:38:52  |  23 阅读

AMD正面对决英伟达!将AI模型直接固化于芯片,彻底摒弃HBM

当地时间8月6日,AMD正式宣布与总部位于加拿大多伦多的AI推理芯片新创企业Taalas达成最终收购协议。这是继今年年初英伟达斥资200亿美元收购Groq资产之后,AI推理芯片领域的又一重磅交易,意味着行业竞争焦点正从训练芯片加速转向推理芯片。今年2月,Taalas为研发针对人工智能模型优化的芯片筹集了1.69亿美元,累计融资额达到约2.19亿美元。AMD未披露本次交易的具体金额。该收购仍需满足惯例成交条件并获得监管部门批准。Taalas绝技:把模型权重"烙"入硅片Taalas成立于2023年,其核心技术

2026-08-13 10:15:23  |  20 阅读

美智库发布AI推理数据中心垂直安全架构 护航国家算力安全

News国防科技要闻【据美国兰德公司网站8月4日报道】美兰德公司近期推出了《AI推理数据中心:面向国家安全的垂直安全工程架构策略》报告,主张建立垂直安全工程架构,以应对国家级战略对手的多方位威胁,确保国家安全情境中AI模型权重、核心算法及推理数据的机密性与完整性。不同于传统在算力设施上叠加防护的做法,这一架构采用“从理念到电路”的原生安全设计,将安全考量从战略风险层面逐步落实到硬件电路层面,形成全链路的可信防护体系。AI推理数据中心的核心安全机制主要涵盖三大底层架构:首先是全域安全域的隔离,将算力设施划分

2026-08-11 11:34:57  |  36 阅读

AI推理服务器崛起:推理算力需求超训练4-5倍,国产芯片迎来黄金机遇

💡三组关键数据揭示趋势:① 曦望董事长徐冰预测:2026年AI推理算力需求将达到训练需求的4-5倍,推理算力租赁价格半年内上涨近40%② IDC预计:到2028年,推理工作负载占比将攀升至73%③ 美银预计:2026年训练服务器与推理服务器营收将平分秋色,2030年推理占比将达75%英伟达CEO黄仁勋观点更为激进:AI推理的规模将迅速达到训练负载的十亿倍。成本构成训练服务器推理服务器区别计算单元(GPU/ASIC)38%25-30%推理对单卡算力需求相对较低存储组件(内存+SSD)29%35-40%推理对

2026-08-11 08:11:27  |  17 阅读

云天励飞担任AI推理芯片工作组组长,联合产业链共建国产推理生态

近日,中国计算机行业协会人工智能产业工作委员会正式完成工作组授牌仪式,云天励飞被推选为AI推理芯片工作组组长单位。伴随人工智能技术在各行各业广泛渗透,智能算力需求迎来井喷式上升,AI算力的核心已从训练环节向推理环节发生结构性转变,推理算力已成为支撑AI大规模落地、驱动产业革新的关键基石,这一趋势已成为全球AI演进的方向并获得业界普遍认同。不过,当前业内普遍遭遇推理开销偏高、能效表现欠佳、软硬件对接繁琐、组网效率有限、云边端生态分散等实际瓶颈,无论云端、边缘还是终端,都对高能效、高性价比、高兼容性的专用推理

2026-08-10 10:49:34  |  23 阅读

AI基建变局:从算力建设到商业变现的跨越

AI基础设施的主旋律正由“搭建”转变为“盈利”,不过这并不意味着资本投入即将触顶。AI推理Token费用自5月高点回落37.5%,降至1.33美元/百万Token,而Blackwell GPU租金却逆势上扬15.2%至5.18美元/小时。供需两端呈现剪刀差:供给方提价,需求方降价。受限于电力、许可及人力,原定3年的产能扩张计划被推迟至5至10年——建设虽未终结,但盈利模式已初见端倪。花旗分析师Heath Terry指出,智能路由是Token降价的引擎——企业根据任务难度智能调度模型,从而大幅削减成本。然而

2026-08-10 02:19:58  |  23 阅读

AI推理:是错因得正的错觉吗?

作者|John Pavlus《量子杂志》特约撰稿人)发布|2026年7月31日如今,人们越来越笃信人工智能具备真正的推理能力。但直觉往往骗人,科学界对此至今没有统一定论。我想直接抛出核心问题:AI所谓的“推理”,究竟本质是什么?我刻意给这个词加上引号。2024年,业界还普遍对AI推理持怀疑态度,彼时由大语言模型迭代而来的大型推理模型,才刚刚问世。可到了2026年5月,OpenAI一款通用推理模型一举攻克一项知名的数学未解难题,如今再质疑AI推理,似乎显得不合时宜。但一系列相互矛盾的研究结论,彻底颠覆了我对

2026-08-06 04:54:23  |  19 阅读

AI产业投融资动态:芯片、安全与自动化部署成焦点

本期资金动向聚焦AI芯片、自主渗透测试、企业AI部署、印度基础模型、CRM、AI药物开发、训练数据合规、供应链Agent和体育视觉技术。资本持续注入两类项目:一是解决AI扩展中算力、安全、数据和部署限制的解决方案;二是将AI Agent融入企业实际运营,通过降本增效和营收增长来验证商业回报。(1)Olix:获3.12亿美元B轮融资,专注新一代AI推理芯片英国AI芯片企业Olix完成3.12亿美元B轮融资,估值升至33亿美元,由Fundomo领投,Arm、Hudson River Trading、Reed

2026-08-06 02:20:16  |  19 阅读

OpenAI 价格骤降八成,AI 推理迈入平价竞争时代

7月30日,OpenAI 意外宣布大幅削减 API 费用,其主力轻量级模型 GPT-5.6 Luna 的价格跌幅高达80%,每百万 Token 输入费用从1美元降至0.2美元,输出费用从6美元降至1.2美元;中端 Terra 模型降价20%,仅有旗舰 Sol 模型保持原价,并新增了 2.5 倍速度的 Fast 付费选项。此次近乎减半的调价,并非单纯的技术优惠,而是 OpenAI 应对市场竞争和盈利压力的战略反击,也标志着 AI 推理服务彻底脱离高溢价,迈入普惠化、内卷化的新阶段。OpenAI 的调价策略展

2026-08-03 20:07:01  |  26 阅读

AI为何能输出复杂推理过程?原理大揭秘

AI 原理系列当我们使用AI时,若开启深度思考模式,模型会展示一连串的思考轨迹涵盖拆解难题、逻辑推导,甚至自我纠错比如像 “等等,感觉不对,我重新思考一下”这些繁复的逻辑推导究竟是如何实现的?首先,AI大模型的训练主要分为三个阶段预训练阶段监督微调阶段强化学习阶段别担心,这三个概念听起来很深奥,但我会尽量通俗地解释,让你了解核心逻辑让我们开始正题首先,AI大模型在完成预训练后—— 就从 初始模型 升级为 基座模型此时通过海量数据的洗礼,人类世界的常识与物理法则已被内化于模型内部具体是如何内化的?本质上就是

2026-07-21 02:46:04  |  40 阅读

AI为何要先思考再回答

为什么让AI"先思考再回答",答案质量会出现明显差距?思维链 = 引导AI一步步推理后再给出答案不直接问结果,而是让AI把"思考过程"写出来,再得出结论。大模型本质是"猜词器"——你问一个问题,它直接猜最可能的"答案词"。但复杂问题没法直接猜,需要先推理中间步骤。思维链就是让AI把推理过程"写出来"再给答案,效果远好于直接回答。场景举例:合同条款风险评估❌直接问:"这份施工合同有风险吗?"

2026-07-20 14:15:01  |  32 阅读

爱芯元智发布元曦系列大算力新品,推动边缘AI规模化落地

上海,中国——2026世界人工智能大会(WAIC 2026)正式启幕,全球领先的AI推理系统芯片供应商爱芯元智(0600.HK)携完整AI生态重磅亮相。本次参展,爱芯元智以多元应用场景全景呈现AI计算规模化落地成果,集中展出全线AI算力产品矩阵,并首度揭秘爱芯元曦AI推理系列新品。本次展会,爱芯元智集中展示基于自研边缘AI算力底座的全行业落地成果。公司以高能效AI芯片及边、端侧AI技术为核心支撑,赋能生态伙伴打造多形态智能化终端产品,覆盖智慧工业、智慧教育、商业办公、零售民生、具身智能等多元场景,充分展现

2026-07-18 19:04:07  |  25 阅读