2.8万亿参数!中国AI企业推出全球最大开源模型
2026 年世界人工智能大会召开在即,月之暗面推出 Kimi K3,凭借 2.8 万亿参数量刷新全球开源模型纪录,成为国产 AI 进入国际领先行列的重要里程碑。参数好比大脑神经节点,超大规模使模型积累丰富知识、具备深度推理能力,而此次开发并未单纯追求体量,核心依赖自主研发架构解决算力消耗问题,突破了大模型越大越难实用的行业困境。模型采用改进的 MoE 混合专家框架,896 个专家模块按需仅启用 16 个,配合自研增量注意力架构,算力利用效率比前代提高 2.5 倍。100 万词元超长上下文加原生多模态功能,
月之暗面发布Kimi K3:2.8万亿参数模型即将开源
新浪科技讯 7月17日晨间消息,月之暗面于今日凌晨正式发布Kimi K3,声称这是公司迄今为止性能最强大的模型。据介绍,Kimi K3拥有2.8万亿参数,采用KDA混合线性注意力机制(Kimi Delta Attention)与注意力残差(Attention Residuals)技术,原生具备视觉理解能力,并支持100万token的上下文窗口。 Kimi K3属于开源模型,专为长程编程、知识工作和推理等前沿智能场景打造。月之暗面表示,尽管Kimi K3的整体性能仍不及最强的闭源模型Claude Fable
AI 领域每日要闻 | 2026年7月7日
————————————————————前沿技术【AI大模型】美团LongCat-2.0正式开源,国产芯片厂商集体同步适配7月6日,美团宣布正式开源LongCat-2.0全部模型权重、推理引擎与核心技术文档,原生支持1M超长上下文,专为Agentic Coding场景设计。同一天,华为昇腾、摩尔线程、沐曦股份等多家国内芯片制造商同步完成了全栈适配工作,涵盖模型加载、推理引擎、算子优化、部署验证等关键环节。这是首个完全基于国产算力实现训练与推理全流程的万亿参数大模型,在Agent和Coding等核心能力上已
华为首度公开美团万亿参数大模型部署方案:昇腾A2推理仅20毫秒
快科技7月6日消息,华为CANN(昇腾AI异构计算架构)团队首次公开披露了美团万亿参数大模型LongCat-2.0在昇腾A2芯片上的完整部署方案。 LongCat-2.0,总参数量达1.6万亿,原生支持100万Token超长上下文。该模型是业界首个完全基于国产算力完成训练与推理全流程的万亿参数模型。 此次公开的部署细节显示,LongCat-2.0基于昇腾Atlas A2 192卡集群部署,单机16卡。Prefill阶段采用64张昇腾A2协同调度,Decode阶段采用128卡超大规模专家并行EP部署。 昇腾
美团被曝约束团队采用豆包技术 官方保持沉默
新浪科技讯 7月2日下午消息,据市场传闻,美团内部已开始管控豆包大模型的应用。 消息指出,美团向所有涉及豆包大模型的业务团队发出指令,要求自行核查并计划转向LongCat、DeepSeek等模型,若无法切换,须单独提交审批申请。 针对这一传闻,截至本文发布,美团方面尚未作出正式回应。 据媒体报道,这已不是美团首次收紧对外部大模型的依赖。今年4月,美团对内调整了大模型使用策略,不再鼓励业务采用阿里云提供的Qwen模型。若业务仍需沿用,必须经过上报核准。 值得关注的是,就在6月底,美团推出了全新基础大模型Lo
美团推出LongCat-2.0大模型:1.6万亿参数规模,完全国产化训练
美团今日正式推出全新一代基础大模型LongCat-2.0。据官方介绍,LongCat-2.0实现了业界首个完全基于国产算力完成训练与推理全流程的万亿参数级别大模型,整体参数量达到1.6万亿规模。在此之前,该大模型的测试版本已在OpenRouter平台上线,其总调用量已跃升至全球前三位。其中,在Hermes平台的月度调用量高居全球首位,在Claude Code平台的月度调用量则排名全球第二,仅略逊于Claude Opus 4.8的表现。LongCat项目组透露,计划在近期内逐步开源Infra框架、推理引擎、
AI日报 | 苹果Mac本地部署万亿参数大模型、理想自研AI芯片发布、诺奖得主转投Anthropic
每日9:30 · 5大方向 · 深度解读最近72小时,AI领域连续涌现多个标志性事件:苹果演示利用4台Mac Studio在本地运行万亿参数Kimi K2.6,端侧大模型推理的上限正在被突破;理想汽车推出自研AI芯片马赫M100,宣告车企正全面转型为AI企业;AlphaFold创始人、诺贝尔奖获得者John Jumper离开谷歌加入Anthropic,顶尖AI人才争夺战进入白热化阶段。这些迹象共同指向一个趋势——AI能力正从云端向端侧、从软件向硬件全面渗透,每个领域都在重塑开发者的技术体系。6月18日,苹
AI日报(6月6日):国产芯片实现万亿参数训练,OpenAI以算力换股权
大家好,我是团团🐼今日要闻速递如下:1.深圳国产芯片成功完成万亿参数大模型训练2.OpenAI 向 YC 创业公司提供 200 万美元算力支持方案3.OpenAI 为 ChatGPT 记忆功能推出 Dreaming 升级版4.xAI 发布 Grok 图像转视频预测模型5.Anthropic 限制级 Mythos 被曝存在未授权访问问题6.快手可灵 AI 全球用户数量突破 1 亿大关7.Gemini 系统扩展至 Android Go 入门级设备8.华为云携手 20 余家模型厂商启动生态合作计划9.腾讯推出效
AI日报|5月16日 百度Ernie 5.1训练成本骤降94%、Anthropic市值突破9000亿、蚂蚁推万亿参数开源模型
每日 3 分钟,洞悉 AI 行业今日动态5 月 11 日,百度正式推出 Ernie 5.1,运用突破性的“一次性弹性训练框架”,将预训练费用削减 94%,仅达竞品的 6%。在 Arena Search 榜单上以 1223 分位列全球第四、国产模型之首,且总参数量仅为前代的 33%。百度同步组建「百度模型委员会」( BMC ),成员均为青年大模型专家,基础模型部与应用模型部统一向 BMC 汇报。显然,百度意在集中 AI 力量精准发力。5 月 15 日, Anthropic 完成新一轮融资, Dragonee
AI算力重组:马斯克困局与Kimi逆袭
就在同一天,国内大模型独角兽Kimi( 月之暗面)完成约136亿元D轮融资,投后估值突破1362亿元,创下中国大模型史上最大单笔融资记录。仅用了半年时间,估值就实现翻四倍,累计融资金额也超过了300亿元。一南一北,两件事共同折射出全球AI竞争正在加速改写版图。xAI成立于2023年7月,其创始团队汇聚了来自OpenAI、谷歌DeepMind、微软研究院等机构的关键AI人才。马斯克的路线同样清晰,他希望打造能够“理解宇宙本质”的AI,并直面OpenAI展开竞争。然而现实往往比愿景更苛刻。据《The Info
清华五道口AI俱乐部:万亿模型百倍提速,千亿投资与政府级项目齐发
大家早安!这里是清华五道口AI俱乐部,每日为您呈现最新的AI行业动态。蚂蚁百灵推出万亿参数模型Ling-2.6-1T,聚焦“快思考”模式,对标GPT-5.4非推理版本近期,蚂蚁集团百灵团队发布了万亿级旗舰模型Ling-2.6-1T。该模型融合了MLA与Linear Attention架构,创新性地放弃了主流的“慢思考”推理方式,通过极低的Token消耗实现高效的“快思考”推断。这不仅大幅削减了计算成本和响应时间,还确保了性能的卓越。在综合实力上,Ling-2.6-1T直逼GPT-5.4非推理版,并在AIM
美团发布万亿参数大模型LongCat 2.0,开启免费测试
新浪科技4月24日讯,美团旗下的新一代基础大模型LongCat-2.0-Preview已开启测试,该模型总参数规模突破万亿,跻身全球顶尖水平。官方信息显示,测试期内,LongCat-2.0-Preview每天将为用户提供1000万Token免费额度。 知情人士透露,在总参数量和激活参数量上,美团LongCat-2.0-Preview与当日发布的DeepSeek新一代V4大模型相当。参数量决定了大模型的知识容量上限及存储成本,两者均支持1M上下文窗口,可在单次推理中处理百万级字数,性能堪比新发布的GPT-5
DeepSeek V4即将亮相:新增FP4支持并针对NVIDIA显卡优化
快科技4月16日消息,DeepSeek V4的发布时间一直是业界关注的焦点,预计将在4月下旬正式发布。近期又有网友发现DeepSeek的GitHub仓库出现了重大更新,展现出一些令人振奋的技术升级。DeepSeek研究团队在官方仓库DeepGEMM中更新了110个文件,其中蕴含的信息量相当丰富。首先是对FP8和FP4精度的全面支持。FP8支持此前已经确认,而FP4即使放到2026年也是相当新颖且激进的技术选择。FP4具备更强的性能表现,显存需求理论上比FP8还要低约一半,这也预示着V4大模型的规模将会非常
日本AI国家队剑指2030:万亿参数"物理智能"來袭,9大财团联手围猎
“物理智能”对阵“具身智能”万亿级工业基础大模型看到这则消息时,我们绝对不能轻视它的意义。软银、索尼、本田、NEC等9家日本顶尖企业正式携手,共同创立"日本人工智能大模型公司"。他们的目标极为清晰:在2030年前,研发出一个具备万亿参数的"物理智能"大模型。业内专业人士都清楚,这绝非一次寻常的商业携手,而是日本倾全国之力的AI绝地反击。组建“国家队”日本的重兵团与中国的“热带雨林”此次日本9大巨头联合的背后,有着强烈的政府意愿。在日本经济产业省(METI)的积极推动下,这种典型的“国家队”模式,试图通过集
AI行业日报 | 2026.04.10 | 八线突破:长时工作、三维交互、娱乐人格、国产新秀、万亿模型、价格重构、人才竞逐
📅 2026年04月10日 星期五导语:智谱GLM-5.1刷新“连续8小时工作”能力上限,成为虚拟员工的新参考;Google Gemini进一步增强3D交互与物理仿真能力;SBTI人格测试凭借AI生成和自嘲式标签迅速走红;阿里HappyHorse模型冲上视频榜首;DeepSeek V4预计将于4月下旬亮相,并深度兼容国产芯片;OpenAI上线100美元专业订阅;Anthropic发布顾问工具混合模式;美团推出LongCat北斗实习项目——这意味着AI正由单点式突破迈向全维度、分层次、生态化发展的成熟阶段。