标签

AI生态合力推进词元成本优化与效率提升

记者在2026世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)上观察到,随着智能代理引发词元使用量激增,降低词元成本成为行业焦点。从芯片到计算与电力协同,从大型模型到智能路由方案,各环节均在努力削减词元开销。 目前,国内算力芯片创业领域,张量处理单元(TPU)正成为热点方向。在大规模纯张量AI训练或推理场景中,最新一代TPU的能效和单位词元成本均胜过主流GPU方案。 TPU芯片企业昊芯英的创始人杨龚轶凡指出,将百万词元成本压至最低是当前优化目标,因为高昂算力费用已阻碍AI技术落地。公司新

2026-07-20 09:06:32  |  6 阅读

混元3发布、可灵AI融资30亿、智能体集体下线

TODAY'S HEADLINES今日头条腾讯正式发布混元3大模型正式版,同时元宝AI助手接入该模型并上线免费Agent功能。这是腾讯在大模型领域的又一重要进展,标志着其AI产品矩阵进一步完善。CAPTAIN'S TAKE腾讯在大模型赛道持续发力,混元3的正式版发布显示了其技术积累的成熟度。免费Agent功能的推出也体现了市场竞争加剧下,厂商需要通过差异化服务来吸引用户。华为何庭波发布「韬定律」V2版论文,详细阐述了后摩尔时代的工程落地细节。这一更新版本进一步完善了华为在芯片架构和计算理论方面的技术框架。

2026-07-07 13:16:35  |  55 阅读
单芯片算力突破896万亿次,中昊芯英发布TPU新品「须臾」

单芯片算力突破896万亿次,中昊芯英发布TPU新品「须臾」

IT之家 6 月 30 日消息,中昊芯英今日正式推出新一代全自研高性能 TPU AI 专用芯片「须臾」,软硬件一体化智算底座「泰则 2.0」也于今日同步问世。 据官方介绍,须臾的单芯片混合精度浮点运算能力高达 896 TFLOPS,性能达到前代产品「刹那」的 3 倍;8-bit 推理算力可达 1792 TOPS,能够满足海量 token 高并发推理需求。该芯片在显存容量、片内互联带宽方面均有显著升级,支持超长上下文窗口。单卡典型功耗为 600W,相较传统算力芯片能耗下降 50%,有力推动绿色数据中心发展。

2026-07-01 17:28:26  |  13 阅读

Alphabet计划融资800亿美元 加码人工智能领域投入

谷歌母公司Alphabet正通过股权融资方式募集800亿美元资金,其中包含与伯克夏达成的一项投资合作协议,旨在为其宏大的人工智能发展战略提供资金支持。周一发布的声明披露,此次融资涵盖一项400亿美元的市场发行方案,公司将从第三季度起不定时出售股票。同时还将实施300亿美元的股票及强制可转换优先股承销发行,并完成与伯克夏的100亿美元合作交易。综合各项交易来看,这将成为史上规模最大的股权融资案例之一,也为今年活跃的首次公开募股市场增添了新的变数。上市公司如此大规模募集股权资本并不常见,但人工智能业务的经济效

2026-06-02 12:39:24  |  11 阅读

Alphabet携手黑石打造AI云计算合资企业

据内部消息,Alphabet旗下谷歌和黑石集团打算利用谷歌自主研发的专用芯片,共同创建一家人工智能云服务企业,以应对CoreWeave等行业竞争对手的挑战。知情人士透露,谷歌与黑石计划组建一家尚未正式命名的合资企业,黑石将投入50亿美元资金并掌握控股权。该合作预计将在本周一晚间正式对外公布。此次合作标志着谷歌迄今为止最重大的举措,旨在向外部客户开放并商业化其芯片技术,这将使谷歌与人工智能计算领域领头羊英伟达的竞争更加激烈。据知情人士称,这家新企业计划在2027年实现500兆瓦的发电能力上线——相当于美国一

2026-05-19 09:14:13  |  34 阅读

AI训练为何离不开海量显卡

前些天看个视频,有人秀自己用电脑跑AI,显卡风扇狂转跟直升机一样,评论区都在问:你这卡多少钱?非得用显卡?CPU不行吗?这个问题问得很到位。我也曾这么想,直到自己试着跑了个开源模型,才明白搞AI的人为啥成箱成箱地买显卡,跟囤大米一样。先讲个真事。我去年用老电脑试跑一个叫LLaMA的模型,7B参数,算是小版本。配置是i7-8700K,32G内存,一张GTX 1060 6G显卡。结果猜怎么着?跑起来直接卡死,画面定格,鼠标动不了,最后只能按机箱重启。后来换CPU跑,能动了,但生成一句话要等40秒,中间泡了杯茶

2026-05-09 02:14:54  |  13 阅读

权威财报说话:AI投资还能信

最近海外四大云巨头的财报接连发布,看完最直观的体会是:市场此前担心的 AI 开支放缓根本站不住,景气度的投资逻辑依然成立。无论是五一假期期间,还是假期之后半导体需求的大规模回暖,都能印证这一点。在我看来表现最强的是谷歌:这次几乎是“全方位超预期”,交出了一份让人挑不出毛病的成绩单。本季度谷歌整体营收同比增长了 22%,其中云业务更是亮眼,收入增速直接达到 63%;连运营利润率也拿到了 33%,听起来是不是很夸张?更关键的是,谷歌云的订单积压较上季度几乎翻倍,累计到 4600 亿美元;主要驱动来自 AI 需

2026-05-07 09:29:55  |  10 阅读

智能医疗前沿速递 | 2026.05.04

## 🔥 热点聚焦[NVIDIA Nemotron 3 Nano Omni亮相:赋能文档音视频代理的长文本多模态技术]1.NVIDIA推出Nemotron 3 Nano Omni多模态系统,融合文本、图像、视频与音频的联合解析;2.该模型在MMlongbench-Doc、OCRBenchV2、WorldSense等评测中斩获顶尖成绩;3.系统搭载Nemotron 3混合Mamba-Transformer专家架构,集成C-RADIOv4-H视觉编码器及Parakeet-TDT-0.6B-v2音频编码器。([

2026-05-04 22:16:49  |  12 阅读

AI应用溢价逐步超越算力

当Alphabet股价在单日内暴涨逾10%、市值一天增加超4000亿美元,同时英伟达股价却下挫近5%、市值先后跌破5万亿美元与4.8万亿美元这两道门槛时,这场发生在2026年4月底的“冰火两重天”,所折射的绝不只是少数个股的短线波动,而是对AI产业底层估值逻辑的一次深度校准。从推理数据量首次超过训练数据量的宏观拐点,到科技巨头财报中自研芯片板块的大规模呈现,市场正在重新梳理一个核心命题:在AI价值链条之中,究竟哪一环更值得拿到溢价?是供给端的通用芯片,还是把AI能力深度嵌入业务流程并形成闭环的应用方案?答

2026-05-02 20:21:06  |  15 阅读

谷歌拟豪掷400亿美元注资Anthropic,AI算力大战再升级

据消息透露,谷歌母公司Alphabet拟对人工智能新贵Anthropic注入最高400亿美元资金,这一动作将令科技巨头间的AI角逐更加白热化。依照协议条款,谷歌将按3500亿美元估值首轮出资100亿美元,若Anthropic达成既定业绩里程碑,还将额外追加最高300亿美元。此外,谷歌云承诺在未来五年内向Anthropic供应约5吉瓦算力,并保留后续扩容空间。Anthropic此番成功募资,核心驱动力在于其AI编程助手Claude Code的突破性进展。该工具大幅提升了软件开发效能,深受硅谷开发者青睐。就在

2026-04-25 04:15:32  |  56 阅读
谷歌拟豪掷400亿美元投资Anthropic 助推AI算力大扩张

谷歌拟豪掷400亿美元投资Anthropic 助推AI算力大扩张

谷歌计划向Anthropic PBC注资100亿美元,未来或再追加300亿,这将进一步加深双方亦敌亦友的复杂关系。Anthropic周五披露,谷歌已承诺以现金方式立即投资100亿美元,公司估值维持在3500亿美元,与今年2月融资时持平(不含后续增资)。同时,谷歌将在Anthropic达成业绩里程碑后追加300亿投资,并协助其大规模扩充计算资源。得益于Claude Code这款能够提速软件开发的AI智能体大获成功,Anthropic正在加速资本运作。本周早些时候,该公司宣布获得亚马逊50亿美元新投资,估值仍

2026-04-25 01:26:31  |  25 阅读

AI日报:2026年4月23日热点速递

DeepSeek V4启动灰度内测GPT-Image-2官宣上线谷歌第八代TPU 8t/8i问世OpenAI三员大将集体请辞 产品主管Kevin Weil、研究主管Bill Gurley及联合创始人Sri尼斯·纳拉亚南于4月19日同步离职。Sora定于4月26日停止服务 每日运维费用达百万美元,用户活跃度却持续走低。SpaceX计划斥资600亿美元收购Cursor 该AI编程助手估值500亿美元,交易若达成将创AI工具收购新纪录。Anthropic年度营收超300亿美元 毛利率从-94%强势反弹至+40%

2026-04-23 12:10:48  |  34 阅读