标签

171个大模型的9年厮杀:2026才算真正开局

史料回望 | 2026年5月3日自2017年Transformer问世以来,这段进程几乎改写了人类的未来走向「一份深度复盘,回看过去9年、171个大模型之间的激烈竞争;最终结论让人意外:2026才是AI全面上扬的起点,而非终点。」当你打开这篇文章时,AI早已被反复提及、几乎成了口头禅。但你可能没留意——从2017年Google Brain推出那篇奠基论文《Attention Is All You Need》起算,至今整整9年,全球至少诞生了171个大语言模型。其中绝大部分,可能你连名字都没听过,就已经被时

2026-05-04 02:03:24  |  23 阅读

AI日报:推理成本骤降,多模态架构统一

今天是2026年4月29日,为您汇集AI行业的最新热点资讯,一同聚焦今日AI领域的重大进展。👉 百万token调用成本迈入个位数时代最新数据显示,过去三年大模型推理成本已下降逾百倍,目前百万token调用成本已降至人民币个位数。硬件优化、量化技术以及推理架构的三重突破共同促成了成本的显著降低。这意味着以往仅限于高价值场景的AI能力,如今可大规模应用于几乎所有行业。成本的断崖式下降正在重塑数字经济的根本逻辑,AI正从“奢侈品”转变为如同水电般的基础公共服务。👉 单一模型处理所有模态,跨模态理解能力实现质变今

2026-04-29 16:10:00  |  44 阅读

深度解析:AI服务器的训练与推理成本构成

AI服务器依据其主要应用领域,可被划分为训练型和推理型两大类。这两类服务器在硬件配置、成本构成以及供应商选择等方面,都展现出明显的区别:概括而言,AI训练服务器的设计理念是“性能优先”,其成本绝大部分(70-80%)集中在GPU的购置上;而AI推理服务器则遵循“能效与成本兼顾”的原则,GPU所占成本比例有所下降(60-70%),相应的,CPU、存储和网络等组件的成本比重则相应增加。在供应商的选择方面,训练型服务器倾向于采用国际顶尖的GPU产品,而推理型服务器则更加侧重于国产化替代方案以及针对特定应用场景的

2026-04-29 12:20:46  |  28 阅读

DeepSeek推出V4版本 大幅优化推理效率

国内人工智能公司DeepSeek正式推出其开源V4模型的预览版本,官方表示该模型在性能基准测试中实现明显进步,同时有效削减了推理开销;得益于该模型能够适配国产化硬件平台,相关芯片企业股价应声走高,其中中芯国际涨幅达9%,华虹半导体上扬15%,而阿里巴巴作为其国内主要竞争者之一也受到市场关注。 责任编辑:张俊 SF065 新浪财经声明:此消息系转载自合作媒体,新浪财经登载此文出于传递更多信息之目的,文章内容仅供参考,不构成投资建议。 郑重声明:1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰

2026-04-24 23:14:17  |  67 阅读
从“对话便宜”到“智能体便宜”:DeepSeek-V4引领大模型价格战进入智能体时代

从“对话便宜”到“智能体便宜”:DeepSeek-V4引领大模型价格战进入智能体时代

每经记者兰素英 每经编辑王嘉琦 报道历经15个月的等待,今日(4月24日),DeepSeek-V4(预览版)终于面世,发布时间紧随OpenAI发布GPT-5.5之后仅数小时。在DeepSeek-V4约1000字的产品介绍中,“智能体”一词被反复提及,共出现11次。DeepSeek-V4通过专家模式(Pro)与快速模式(Flash)的双版本配置,将大模型价格战从“对话便宜”推向“智能体便宜”的新阶段。凭借全新的稀疏注意力机制与同策略蒸馏技术,DeepSeek-V4将推理成本压缩至新低,其中V4-Flash版

2026-04-24 17:52:17  |  43 阅读