奥特曼摊牌:OpenAI放弃暴利,万亿推理收入靠规模取胜
7月底的访谈中,奥特曼直言不讳,追求超高毛利并非其战略重心,这句话让整个AI投资圈为之震惊。这种表态毫无保留,显然是一次公开摊牌。一家投入数百亿资金训练模型、背负万亿基建承诺的企业,其掌门人却宣称未来要走薄利多销之路。这种商业逻辑要么疯狂,要么将颠覆整个AI行业的估值体系。2026年7月28日,在Patrick O'Shaughnessy主持的《Invest Like the Best》第484期中,针对蒸馏威胁,奥特曼抛出了这段备受关注的原话:"We will have so much usag
IBM与Together AI达成2.4亿美元云计算合作
IBM(236.31, 0.72, 0.31%)近日与Together AI签订了一份多年期合作协议,总金额达到2.4亿美元,双方将基于IBM Cloud搭建大规模英伟达HGX B300推理集群,计划在2027年第一季度正式上线运行。Together AI计划借助这一集群资源,面向企业用户推出开源模型推理相关服务。
端侧AI与云侧AI的本质差异在哪里?
谈起端侧 AI,不少人最先想到的是“AI 手机”。这很正常。手机是我们最常接触的智能终端,也是 AI 体验最直接的入口。但如果仅仅把端侧 AI 当作“在手机上跑大模型”,就低估了它的内涵。更核心的问题其实是:在我们使用 AI 时,模型的理解、推理与响应,究竟发生在哪里?一部分任务依靠云端服务器完成,另一部分则可以由设备本机处理。这两种模式对应的,正是大家常说的“云侧”和“端侧”。AI 究竟在何处运算?云侧 AI,是指设备通过联网把请求发送至远端服务器,由云端执行运算,再把结果回传给用户。这种模式适用于算力
直播预告丨AI推理性能深度优化:openFuyao InferNex如何大幅降低TTFT
当算力规模迈入万卡集群、单日Token处理量迈入万亿级别的今天,传统推理架构在KVCache的高效复用、长上下文显存调度、Prefill/Decode资源协同等关键环节遭遇全新的技术挑战。毫秒级的延迟波动与显存资源的无效占用在大规模推理业务场景下会被持续放大,不仅显著推高运营成本,也对终端用户体验带来不利影响。InferNex作为openFuyao面向多样化算力与灵衢高性能总线协议打造的云原生分布式推理加速套件,依托智能路由、PD分离式弹性伸缩决策框架、分布式KVCache管理、推理全链路可观测四大核心子
AI也能算命
那你猜猜我是哪种MBTI人格?它给出的答案是:INTJ 紫老头您找我聊之前,自己先埋头写了两份结构化分析文档。聊的时候也不是想到哪说哪——是一步一步有节奏地往外掏。E人边说边想,您是想完了再给你看。典型的 I。数据模型是业务和IT 的统一语言。它沉默了一秒(别问我AI 为什么会沉默),然后说:您刚才聊八卦的时候,把一件社会新闻拆成了证据链、时间线、人物动机三个维度。一般人吃瓜是'啊然后呢',您是'这个因果逻辑不对'。这不叫八卦,这叫建模。您做了两份分析文档。一份是控辩双方攻防推演,一份是司法统计数据量化。
美智库发布AI推理数据中心垂直安全架构 护航国家算力安全
News国防科技要闻【据美国兰德公司网站8月4日报道】美兰德公司近期推出了《AI推理数据中心:面向国家安全的垂直安全工程架构策略》报告,主张建立垂直安全工程架构,以应对国家级战略对手的多方位威胁,确保国家安全情境中AI模型权重、核心算法及推理数据的机密性与完整性。不同于传统在算力设施上叠加防护的做法,这一架构采用“从理念到电路”的原生安全设计,将安全考量从战略风险层面逐步落实到硬件电路层面,形成全链路的可信防护体系。AI推理数据中心的核心安全机制主要涵盖三大底层架构:首先是全域安全域的隔离,将算力设施划分
AI Agent驱动算力升级,国产半导体自主可控提速
当前,AI产业正从大模型预训练全面转向AI Agent商业化应用,推理算力需求进入爆发式增长阶段。与此同时,国内半导体自主可控步伐加快,上游制造、设备及零部件的国产化已成为产业链突围的关键。核心观点:三大主线清晰,AI Agent拉动算力与存储需求报告显示,2026年AI产业的核心动力已由训练转向推理,AI Agent的落地直接引爆了推理算力需求。据国家数据局数据,2026年3月国内Token日均调用量突破140万亿次,较2024年初增长超千倍。国产大模型与算力已实现“Day 0”适配闭环,国产AI芯片替
AI行业动态简报 20260811
2026-08-11 06:15:31OpenAI 正在筹备 70 亿美元股份出售,旨在为未来的上市做准备。此举表明 OpenAI 的资本运作已步入更公开的资本市场阶段,预计将继续左右行业的估值水平及融资趋势。from:CNBC2026-08-11 06:09:00英伟达正调配资源以应对高达 5000 亿美元的融资需求,黄仁勋在 CNBC 访谈中将自家芯片比作“可投资资产”。该新闻再次将 AI 基础设施需求、市场热度与硬件供给紧密关联,证实算力依然是核心主线。from:CNBC2026-08-11 04:
AI推理服务器崛起:推理算力需求超训练4-5倍,国产芯片迎来黄金机遇
💡三组关键数据揭示趋势:① 曦望董事长徐冰预测:2026年AI推理算力需求将达到训练需求的4-5倍,推理算力租赁价格半年内上涨近40%② IDC预计:到2028年,推理工作负载占比将攀升至73%③ 美银预计:2026年训练服务器与推理服务器营收将平分秋色,2030年推理占比将达75%英伟达CEO黄仁勋观点更为激进:AI推理的规模将迅速达到训练负载的十亿倍。成本构成训练服务器推理服务器区别计算单元(GPU/ASIC)38%25-30%推理对单卡算力需求相对较低存储组件(内存+SSD)29%35-40%推理对
重塑智能主体:走向'去设计人工智能'的下一个十年——同济设计人工智能实验室2026开放日
2016年,我在同济大学挂牌成立了一个机构,名为《设计人工智能实验室》。彼时,“设计人工智能”于我而言只是一个学科名称——一个尚未长出内部结构的偏正短语,类似于“计算语言学”或“生物物理”,用来指认一块当时几乎无人涉足的交叉地带。我只知道设计与人工智能理应被并置,却并不明了它们之间应当遵循怎样的语法规则。十年倏忽而过,这五个字未曾改动分毫。但我渐渐体悟到,这五个字其实存在三种读法,每一种读法都映射着实验室的一个阶段。第一种读法:设计人工智能。作为学科名,它所标记的,是“这两件事理应被并置”这一直觉本身。第
AI应用企业毛利逻辑首次接受实战检验:Canva战略减速,Figma独自承担推理开销
设计软件领域的两大头部企业正以真实的财务数据,暴露出AI转型过程中最为隐蔽的代价。Canva本周向投资人发出预警,年度营收增速将回落至20%,原因在于公司主动暂停了一项原本旨在拉动付费订阅增长的AI功能规模化推广——市场需求远超预期,服务端支出同样远超预期。Figma周四发布的财报显示,预计第三季度营收增速将从6月季度的48%下滑至36%,并坦言旗下多款AI工具仍处于测试阶段,尚未跑通清晰的商业化路径。消息披露后,Figma股价单日大跌约15%。据科技媒体The Information报道,两家企业遇到的
AMD拿下Taalas 加码AI推理ASIC硬件布局
Taalas的技术核心可归纳为"模型即硅基硬件"。在现有的通用GPU或TPU框架内,模型参数与权重数据存放于外部高带宽存储器内,运算时须通过高密度互连通道在存储与计算单元之间反复进行数据迁移。这种存算解耦的冯氏架构高度依赖高密度先进封装、三维堆叠工艺、超高IO带宽以及大功耗液冷散热方案。Taalas的革新之处恰恰是解除了对高带宽内存与先进封装的刚性依赖:模型权重硅基烧录:Taalas将固定的模型架构与绝大多数权重参数直接固化写入芯片的掩模ROM存储结构中。片上缓存深度集成:芯片将键值缓存与微调适配器直接嵌
AI与机器人产业:大模型落地的关键转折期
AI与机器人产业:大模型落地的关键转折期推理成本在一年半时间里下降九成以上,开源模型性能逼近闭源顶尖水平,企业级AI落地正从概念验证迈向大规模部署。2026年下半年,大模型领域的竞争重心已从"谁的模型参数更大"转变为"谁能以更低成本、更深程度使用模型",行业落地的转折点正在到来。一、推理成本断崖式下跌:价格瓶颈被打破2024年初,GPT-4级别的接口调用费用约为每百万token 30美元。到2026年8月,同等性能模型的调用成本已降至约1-3美元——降幅超过九成。这一变化的驱动力来自三个方向。其一,架构层
云天励飞担任AI推理芯片工作组组长,联合产业链共建国产推理生态
近日,中国计算机行业协会人工智能产业工作委员会正式完成工作组授牌仪式,云天励飞被推选为AI推理芯片工作组组长单位。伴随人工智能技术在各行各业广泛渗透,智能算力需求迎来井喷式上升,AI算力的核心已从训练环节向推理环节发生结构性转变,推理算力已成为支撑AI大规模落地、驱动产业革新的关键基石,这一趋势已成为全球AI演进的方向并获得业界普遍认同。不过,当前业内普遍遭遇推理开销偏高、能效表现欠佳、软硬件对接繁琐、组网效率有限、云边端生态分散等实际瓶颈,无论云端、边缘还是终端,都对高能效、高性价比、高兼容性的专用推理
中国AI大模型重塑全球调用新格局
近期,国际模型聚合平台OpenRouter公布的最新周度Token(词元)调用排名发生里程碑式转变:榜单前五位均由国产大模型占据,其中DeepSeek V4 Flash拔得头筹,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro以及智谱GLM5.2分列二至五位。DeepSeek V4 Flash正式版本推出后,其日均调用量与合作平台新增订阅用户均攀升约30%,凭借显著的性价比竞争力,重塑了全球AI开发者的使用习惯。 DeepSeek缘何登顶全球调用榜?这折射出我国大模型产业怎样的竞争实力?