标签

OpenAI与Cursor正式决裂

OpenAI方面已经确认,将于今年11月12日正式切断Cursor对GPT系列模型的调用接口。事件的起因颇为戏剧性——马斯克完成对Cursor的收购后,直接点燃了这场冲突的导火索。奥特曼与马斯克之间看来已彻底站到对立面,双方的恩怨无从化解。而Cursor的用户群体反应倒是相当淡定,不少人直言不讳:Claude、Grok哪个不比GPT能打?只能说AI圈这场大戏越来越精彩了。尽管Cursor订阅通道里暂时用不上GPT,OpenAI还是给出了一条绕行方案——通过接入API Key的方式继续调用GPT模型。不过这

2026-08-29 12:50:15  |  12 阅读

OpenAI自研推理芯片Jalapeño亮相:算力与能效双向超越英伟达

老灯 · 2026年8月29日8月25日,OpenAI在Hot Chips 2026大会上首次公开了其自研推理ASIC芯片Jalapeño,该芯片与博通联手打造,从RTL到tapeout仅耗时九个月。核心规格如下:13.4 PFLOPS MXFP4算力,216 GiB HBM4带宽,功耗控制在700W。单芯片可扩展至2,048片集群规模,整体性能可达27 exaflops算力与432 TiB HBM4容量。研发时间线:2024年底提出概念→2025年完成RTL freeze→2025年底实现tapeout

2026-08-29 09:38:16  |  11 阅读

投资课堂 | AI推理芯片究竟是什么?

推理芯片(Inference Chip)是一种专为驱动AI模型运行而定制的处理器,主要在模型完成训练之后承担实时响应用户输入、产出结果的任务(即所谓的"推理"环节)。与一味追求极致算力的"训练芯片"相比,推理芯片更看重低时延、低功耗、高能效比以及低成本1. 核心职能与运行机制职能:把已经训练完毕的AI模型落地到真实业务场景中,应对用户的实时调用(包括对话、图像识别、语音翻译等),完成即时数据处理与智能判断。机制:模型权重已经锁定,不再需要反向传播与梯度计算,根本理念是"效率至上",借助对计算精度与硬件结构

2026-08-28 20:51:05  |  6 阅读

OpenAI亮出自研推理芯片Jalapeño,公开数据叫板英伟达旗舰

OpenAI对外公开了其首款定制推理芯片Jalapeño的全部测试数据,这款绰号墨西哥辣椒的全新产品,呈现了大量横向对比结果,正面硬刚当下英伟达的顶级硬件产品。不少读者看到性能比拼的消息,很容易以为市场上很快就能购得该芯片。事实并非如此,该芯片首先满足OpenAI内部业务的需求,外部厂商目前拿不到成品。真正值得留意的是,这件事给整个AI产业链带来的深远影响。必看从零开始构建,九个月跑完全部芯片研发流程Jalapeño由OpenAI与博通联手打造,整个项目从立项设计到产出样片,仅耗时九个月,这一节奏在高性能

2026-08-28 19:47:10  |  8 阅读

清华系AI芯片公司原粒半导体三个月内融资突破12亿元

编译整理 | Stark瞰未来日前,聚焦Agent Computer架构与推理芯片研发的AI芯片初创企业原粒半导体宣布完成逾7亿元A轮融资。本轮融资由九安医疗、汤臣倍健等上市公司及多家投资机构联合参与,老股东继续追加投资。截至目前,该公司在短短三个月内累计融资规模已突破12亿元。原粒半导体成立于2023年4月,其核心技术为"积木式AI芯片",并已搭建三大底层技术体系。今年5月,公司首款端侧生产力AI芯片CCS-1系列顺利完成流片并成功点亮,相关产品正面向企业办公、工业智能等场景推进落地。(

2026-08-12 10:34:15  |  17 阅读

AMD拿下Taalas 加码AI推理ASIC硬件布局

Taalas的技术核心可归纳为"模型即硅基硬件"。在现有的通用GPU或TPU框架内,模型参数与权重数据存放于外部高带宽存储器内,运算时须通过高密度互连通道在存储与计算单元之间反复进行数据迁移。这种存算解耦的冯氏架构高度依赖高密度先进封装、三维堆叠工艺、超高IO带宽以及大功耗液冷散热方案。Taalas的革新之处恰恰是解除了对高带宽内存与先进封装的刚性依赖:模型权重硅基烧录:Taalas将固定的模型架构与绝大多数权重参数直接固化写入芯片的掩模ROM存储结构中。片上缓存深度集成:芯片将键值缓存与微调适配器直接嵌

2026-08-10 11:23:26  |  19 阅读
谷歌推Frozen v2芯片,AI算力效率提升十倍

谷歌推Frozen v2芯片,AI算力效率提升十倍

两名知情人士透露,谷歌正在开发一款全新服务器芯片,该芯片将 Gemini 大模型的底层架构直接固化在硅基硬件中,能够极大提升谷歌向用户提供 AI 服务的运行效率。 这款内部代号为 Frozen v2(固化二代)的芯片,旨在缓解谷歌当前严峻的 AI 算力缺口。算力不足不仅引发了谷歌内部各部门的矛盾,还导致谷歌云不得不回绝大量外部客户的算力采购订单。参与该芯片研发的工程师测算,按单位功耗可处理的 Token 数量(AI 算力核心计量指标)计算,该芯片正式落地后,其能效可达谷歌现有最新一代自研 AI 张量处理器

2026-07-21 00:23:39  |  28 阅读

4亿美元推理芯片抵押融资落地,AI投资风向转变

AI推理云初创企业General Compute近日从科技投资机构Upper90处成功获取4亿美元贷款。这或许标志着全球首笔以专用推理芯片作为抵押物的融资案例——此类芯片旨在高效运行已训练完成的AI模型,而非用于构建模型的高成本训练芯片。 本轮融资反映了市场对AI工具及Token价格波动的最新应对策略,投资者正纷纷转向基于开源模型的基础设施,其运营成本远低于前沿实验室最新推出的大语言模型。 General Compute由CEO Finn Puklowski和CTO Jason Goodison联合创立,

2026-07-18 01:18:41  |  28 阅读

AI自研芯片时代来临:九个月造芯颠覆行业

Michael | 五源资本投资人2026年6月,OpenAI与博通联合发布了一款名为Jalapeño的推理芯片。其具体参数未公开,但两点突破更引人注目:第一,这颗芯片完全由OpenAI基于自身模型架构、未来路线图与推理体系从零定义,博通负责硅片实现——OpenAI不再满足于采购通用算力,而是追求量身定制的硬件。第二,这款逼近光罩极限的先进制程芯片,从立项到流片仅耗时九个月,据双方称,创下高性能芯片开发速度的历史纪录。缩短周期的关键助力,正是OpenAI自研的AI模型。AI芯片的上半场已告一段落,英伟达是

2026-07-13 12:35:45  |  37 阅读

AI产业观察:竞争重心转向电力、推理芯片及合规治理

观物如实-拒绝碎片化认知。本文基于2026年7月9日前的公开资料梳理,重点探讨AI产业技术迭代、企业应用、成本控制及合规体系建设。本文仅供行业参考,不作为投资、法律或合规建议。截至当前,AI产业已从单纯的“模型能力比拼”深化为“基础设施、终端入口及治理体系”的全方位角逐。在硬件与基础设施层面,Meta宣布在加拿大阿尔伯塔省Sturgeon County建设1GW规模数据中心,涵盖电力、基建及冷却方案。这表明大型AI基建已超越单纯采购GPU,演变为电力供应、冷却系统、本地配套及长期运维的综合工程。此外,Pe

2026-07-09 10:34:07  |  45 阅读
资本加注AI芯片挑战者,SambaNova跻身百亿美元独角兽

资本加注AI芯片挑战者,SambaNova跻身百亿美元独角兽

核心要点 一家 AI 芯片初创企业完成 10 亿美元新一轮融资,资本持续涌入各类意图挑战英伟达的芯片厂商。 本轮融资由泛大西洋投资集团领投,塞利格曼风投、普信集团、资本集团跟投,融资完成后 SambaNova 整体估值达到 110 亿美元。 该公司于周三官宣本次融资,今年早些时候它已完成超 3.5 亿美元融资,投资方包含英特尔(109.35, -1.04, -0.94%),双方同期还达成战略合作。 公司联合创始人兼首席执行官罗德里戈・梁在巴黎举办的 Raise AI 峰会上接受 采访时表示:“推理市场彻底

2026-07-08 21:41:58  |  32 阅读
获三星投资的AI芯片企业Rebellions,CEO定档明年韩国IPO

获三星投资的AI芯片企业Rebellions,CEO定档明年韩国IPO

核心摘要 Rebellions 首席执行官独家透露,借着全球资本对 AI 芯片领域的狂热追捧,公司规划在明年第一季度或第二季度于韩国进行首次公开募股。 Rebellions 首席执行官朴成铉透露,与韩国创业板 KOSDAQ 相比,公司更倾向于登陆韩国综合股价主板 KOSPI。 他在周三接受采访时表示:“我们已经实现了稳定的实际收入,因此正联合承销商摩根大通(339.22, 1.50, 0.44%)和三星证券筹备上市事宜。” 他补充说:“我们的投资者更看好韩国市场,特别是 KOSPI 主板。我们深度参与韩国

2026-07-08 21:12:03  |  51 阅读

智谱AI自研芯片计划曝光:大模型厂商掀起造芯潮

7月7日,美国媒体The Information披露,智谱正在评估自研定制AI芯片项目,目前仅处于早期接洽阶段。多位内部人士透露,智谱已主动联系本土芯片设计企业,计划联合开发适配GLM系列模型的专用ASIC芯片,全程采用国内晶圆厂进行流片,并不打算从零开始建立完整的芯片团队。此次涉足芯片领域,主要面临两大现实挑战:首先,GLM-5.2上线后调用量急剧攀升,算力缺口直接制约业务扩展,代码、多模态套餐长期处于供不应求状态,通用GPU适配效率低下、推理成本始终高企。其次,智谱已被列入美国实体清单,高端英伟达显卡

2026-07-08 15:45:50  |  55 阅读

DeepSeek估值近4000亿!自主研发AI推理芯片引关注

据内部人士透露,中国人工智能企业DeepSeek正在开发自家人工智能芯片,此举有望减少对海外芯片的依赖。此前该公司一直依靠这些芯片来训练和运行其全球热门的人工智能模型。知情人士指出,该芯片的设计目标是推理阶段(即人工智能计算中已训练模型为用户提供答案的环节),而非训练新模型。若研发成功,DeepSeek进入半导体研发领域将标志着这家中国人工智能龙头企业的一次重大战略转变。“英伟达在中国的市场份额为零,而且将持续保持零增长。除非DeepSeek能够获得先进的制造工艺,否则它几乎没有可能在国际市场销售芯片,”

2026-07-08 09:15:47  |  34 阅读

AI跨界造芯:OpenAI首款推理芯片Jalapeño正式亮相

从架构定义到流片仅用9个月——这是高性能芯片领域最快的ASIC开发周期。完成这一壮举的不是传统芯片厂商,而是人工智能公司OpenAI。2026年6月24日,OpenAI携手博通推出了首款定制推理芯片Jalapeño,性能可与英伟达Blackwell和谷歌TPU媲美,推理成本预计降低约50%。AI设计芯片,芯片驱动AI——一个自我加速的闭环正在形成。这股潮流会波及国内吗?关键观察要点① 芯片规格与合作模式。 Jalapeño是推理专用ASIC(不涵盖训练),采用台积电3nm工艺,9个月内完成流片。OpenA

2026-06-30 12:55:24  |  31 阅读