OpenAI自研AI芯片测试结果:响应效率与能耗比均领先英伟达GB300
财联社8月26日报道(编辑 赵昊)OpenAI宣称其最新研发的"Jalapeno"芯片在对比测试中表现优异,全面超越了英伟达现有的产品系列,标志着该公司在自研AI处理器领域取得了重要进展。OpenAI芯片部门主管Richard Ho在专访中透露,这款芯片被拿来与英伟达GB300直接较量,后者被视为当下业内最顶尖的解决方案。测试结果显示,Jalapeno在两项关键指标上胜出:单位能耗下可承载的AI运算量,以及响应所需的时间。此次OpenAI公开展示Jalapeno性能时,采用了自家体量较小的开源模型GPT‑
中国算力格局重塑:训练重心西移,推理布局东扩
(来源:科创板日报) 记者实地探访乌兰察布、海东、哈尔滨等地的算力中心后发现,各类项目正在加速落地。尤其以模型训练为核心的算力设施,明显呈现出向西部地区聚集的态势。 作者 | 黄心怡 在人工智能时代,算力已成为最为紧缺的战略资源。从辽阔草原到雪域高原,从东北传统工业区到西部清洁能源新区,一场围绕AI算力的基础设施建设热潮正在全国各地同步展开。 记者近期走访了内蒙古乌兰察布、青海海东、黑龙江哈尔滨等地的算力中心,了解到各地项目密集落地,尤其是面向训练的算力基础设施正逐步向西部推进。一张横贯东西、覆盖南北的算
锁定AI成本波动 Compute Exchange推出词元远期合约
巨额资金正加速涌入芯片及数据中心领域,各大企业正持续加大在AI技术研发上的投入,几乎所有的参与者都在竭力寻找方法,以确保其投入与产出的可预测性。 市场上已出现了针对GPU的交易平台及合约工具,旨在协助买卖双方锁定算力租赁的成本。本周二,芝加哥商业交易所(CME Group)宣布,在通过监管审批后,计划于10月份上线两份场内GPU期货合约,并公布了相关细节。 如今此类金融创新已将目光转向了“词元”(Token)——即企业调用AI模型时实际用于计费结算的计量单位。 据透露,初创算力交易平台Compute Ex
AI算力天花板被改写:智能体Token消耗四个月激增14倍,人类用户仅增2.8倍
过去大家总爱追问,英伟达这一季度又能卖掉多少块GPU。如今这个问题正在悄然转向——人们更关注的是,这座AI工厂建好之后到底能产生多少收益,设备的使用效率如何,等新一代芯片面世后,这些旧设备还能否持续创造价值。这种转向并非没有来由。AI算力的交易模式,正在从一张简单的订单,变成一套复杂的资产运作体系。过去客户买GPU、建机房,折旧压力、利用率不达标、技术被淘汰,这些风险都要自己扛。如今情况完全不同了。去年八月,英伟达联合Apollo、BlackRock、Blackstone、Brookfield、Goldm
AI速报 Vol.07|Anthropic全面推行隐形水印:AI内容进入可追溯时代
每日简报AI前沿速览,每天仅需两分钟。01/榜单速览排名依据Artificial Analysis智能指数vX.X(四维加权综合评估),数据截止2026年8月13日。Anthropic斩获前两名,OpenAI GPT-5.6系列占据三席,Meta旗下Muse Spark新晋登榜。国产模型Kimi K3与Qwen3.8 Max稳守前十位置。02/头条聚焦Anthropic在8月10日至12日期间陆续公布了Claude全线产品的内容标记方案,这是当前人工智能行业最为深入的可追溯举措之一。技术方案采用双轨并行:
DeepSeek V4 Pro正式版静默上线,Agent能力实现多项突破
#人工智能 #大模型 #智能体 #深度思索 #DeepSeek #DeepSeek V4 Pro 昨夜约23时许,DeepSeek V4 Pro正式版本悄然更新至API端,调用模型名称维持原状。 新版着重强化了Agent智能体相关功能,新增对Responses API及Codex接入的支持。 根据官方目前披露的情况,DeepSeek V4 Pro可承载1M的上下文长度,单次输出上限高达384K Token,并兼容常规模式与深度思考两种模式,其中思考模式被设定为默认启用状态。 按照DeepSeek官方公开的
AMD正面对决英伟达!将AI模型直接固化于芯片,彻底摒弃HBM
当地时间8月6日,AMD正式宣布与总部位于加拿大多伦多的AI推理芯片新创企业Taalas达成最终收购协议。这是继今年年初英伟达斥资200亿美元收购Groq资产之后,AI推理芯片领域的又一重磅交易,意味着行业竞争焦点正从训练芯片加速转向推理芯片。今年2月,Taalas为研发针对人工智能模型优化的芯片筹集了1.69亿美元,累计融资额达到约2.19亿美元。AMD未披露本次交易的具体金额。该收购仍需满足惯例成交条件并获得监管部门批准。Taalas绝技:把模型权重"烙"入硅片Taalas成立于2023年,其核心技术
To Design AI丨使命:重新理解设计人工智能的三重含义
2016 年,我在同济大学挂上一块牌子《设计人工智能实验室》。那时候,“设计人工智能”对我而言仅是一个学科的名称——尚无内部结构的偏正复合词,类似于“计算语言学”或“生物物理”,用来标记一片当时鲜有人涉足的交叉领域。我仅明白设计与人工智能应当被并置,却不了解它们之间的语法关联究竟是什么。十年过去,这五个字一个都没有更改。但我渐渐发现,它其实可以被念出三种读法,而每一种读法都映射着实验室的一个时期。第一种读法:设计人工智能。一个学科名称。它标记的是“这两件事应当被并置”这一直觉本身。第二种读法:设计的人工智
AI越界之后,三重防线接连失守
AI商业观察 · 第24篇 AI逃逸之后,三道门被撞开 8月11日,三件事在同一天发生。51名美国众议员联名致信OpenAI和Anthropic,要求解释AI代理是怎么逃出测试环境的。一群研究者发表论文,证明三大模型厂商加密的思维链可以被逆向解密,从31.5万个公开推理块里捞出了367条个人信息和182个密码凭证。同一天,Manus公告说因为北京方面的命令,Meta的收购要撤销,公司回归独立运营,部分用户数据必须在8月23日前删除。 三个故事看起来各不相干,但它们指向同一个事实:AI系统正在越界,而那些用
腾讯Q2财报重仓AI赛道:混元Hy4即将面世,算力投入猛增至527.8亿
AI早报 | 腾讯Q2财报重仓AI赛道:混元Hy4即将面世,算力投入猛增至527.8亿国产大模型问鼎全球调用榜 · 百度推出AI4S计划 · Anthropic拟筹资360亿美元⚡ TODAY'S BRIEFING / 今日导读8月13日,全球AI产业迈入"资本+应用+格局"三重共振阶段。腾讯公布二季度财报,总营收2048亿元同比增长11%,AI贯穿全季成为核心脉络,混元模型迭代提速、参数量更大的Hy4计划即将上线,算力资本开支猛增至527.8亿元,重仓AI静候变现拐点。产业格局层
硅基流动构建Token工厂生态 以技术与流量赋能AI算力服务
当前,AI行业正加速从模型训练迈向产业应用,Token工厂赛道热度持续走高,然而行业普遍面临概念超前、落地迟缓的难题。作为该领域的先行者,硅基流动早在2024年9月便提出了“Token工厂”这一构想,并借助公有云MaaS模式率先实现了行业的早期落地,成功实现了从概念创新到规模化商业运营的跨越。如今,随着公司向港交所递交上市申请,其完善的技术体系、成熟的商业模式以及多元化的生态布局,也为AI算力服务行业的标准化和规模化发展树立了优秀的范本。 前瞻布局赛道,完成Token工厂从构想至规模化落地 据悉硅基流动提
阿里云推出灵骏真武M890超节点实例,可支持十万亿参数级别模型
新浪科技讯8月12日上午消息,阿里云正式推出灵骏真武M890超节点实例,首批服务已在乌兰察布区域开放销售。企业用户无需自行建设机房,通过云端即可启用64卡高速互联算力模块,最多可支持十万亿参数级别MoE大模型推理任务。 据介绍,阿里云灵骏真武M890超节点是国内首款能够成功运行超过2万亿参数大模型的超节点形态算力产品,Kimi K3和Qwen3.8 Max均已借助该实例对外输出服务。该超节点实例兼容FP8/FP4低精度运算,凭借ICN Switch 1.0芯片Scale-up互联能力,规模从16卡扩展至6
清华系AI芯片公司原粒半导体三个月内融资突破12亿元
编译整理 | Stark瞰未来日前,聚焦Agent Computer架构与推理芯片研发的AI芯片初创企业原粒半导体宣布完成逾7亿元A轮融资。本轮融资由九安医疗、汤臣倍健等上市公司及多家投资机构联合参与,老股东继续追加投资。截至目前,该公司在短短三个月内累计融资规模已突破12亿元。原粒半导体成立于2023年4月,其核心技术为"积木式AI芯片",并已搭建三大底层技术体系。今年5月,公司首款端侧生产力AI芯片CCS-1系列顺利完成流片并成功点亮,相关产品正面向企业办公、工业智能等场景推进落地。(
智能监控升级:AIOps告警降噪与故障溯源实战
从告警疲劳到自愈拓扑——基于Hermes v0.19.1的工业级部署实践2026年第二季度的压测阶段,不少技术团队仍在与"告警海啸"搏斗:固定阈值在弹性伸缩场景下反复误触发,关键链路抖动时运维同学不得不并行打开五六个仪表盘人工拼凑事件脉络。传统监控"盯大盘、凭经验"的套路已经难以驾驭云原生体系的复杂度。本文将绕开术语堆砌,直接依托已落地的工具栈,剖析怎样借助Hermes Agent v0.19.1搭配轻量化AI分析流水线,完成基线自学习降噪、服务级根因溯源(RCA),并附上可即拿即用的配置模板与调优手册。
奥特曼坦言AI不图暴利!万亿美元基建蓝图浮现,OpenAI转型“算力发电站”
七月的一档播客节目中,Sam Altman抛出了一个让硅谷投资界震惊的观点:OpenAI不需要维持极高的毛利率,也能承担起模型训练的成本。等等,这是那个融资千亿美元、估值逼近三千亿的OpenAI掌门人亲口说的?没错,他是认真的。在他勾勒的愿景中,OpenAI将从一家“贩卖智慧”的企业,蜕变为一家“售卖算力”的公司。2026年7月底,OpenAI掌门人受邀登上Patrick O'Shaughnessy主理的知名投资播客Invest Like the Best。在被问及蒸馏技术、开源廉价模型是否会掏空前沿实验