标签

AI 日报:大模型调用激增 / 法拉利首辆纯电 SUV 亮相 / 腾讯 ima 全量开放

点击上方关注我们01全球 AI 大模型调用量五连涨OpenRouter 最新公布的数据显示,全球 AI 大模型总调用量已攀升至 28.9 万亿 Token,较上周增幅达 7.4%,这是该指标连续第五周环比增长,直观表明全球范围内大模型的使用需求仍在持续爆发,未见饱和迹象。从国家竞争角度看,中国 AI 大模型表现格外抢眼。上周中国大模型周调用量达到 9.22 万亿 Token,环比激增 19.89%;同期美国大模型周调用量为 4.93 万亿 Token,环比增长 16.27%。就具体模型排名而言,上周全球调

2026-05-26 10:42:19  |  10 阅读

面壁智能破局:600亿参数模型仅用8G内存,国产算力领跑端侧AI

通常情况下,运行一个8B参数的大模型大约需要16GB显存,参数规模越大,对显存资源的消耗就越严峻,这也推高了硬件成本。不过,现在出现了一种新技术,能让显存需求骤降6倍,同时尽量维持原有的性能水平。这两年全球都在争夺这一前沿技术,而我国凭借国产算力优势,已率先取得突破。该技术能把模型压缩到3B以内,性能保留率高达97%;配合MoE架构,未来只需8G内存的手机就能运行600亿参数的大模型。这一惊人的技术突破背后有何奥秘?传统大模型通常依赖高精度的数值来存储权重,每个权重的可选数值非常丰富,虽然精度高,但非常消

2026-05-26 09:36:01  |  11 阅读
国内首个1.58比特端侧大模型开源发布

国内首个1.58比特端侧大模型开源发布

IT之家5月25日信息,面壁智能携手清华等机构,今日公布并开源其最新低比特大模型成果BitCPM-CANN。 据透露,该模型为我国首个完全基于华为昇腾平台端到端训练并开源的三值(1.51-bit)大模型。从量化计算、训练方法到整体框架,BitCPM-CANN均在昇腾平台原生构建,提供0.5B、1B、3B、8B四种规模,与同规模MiniCPM4全精度系列逐一对比测试,表现卓越。 相较传统BF16精度,BitCPM-CANN在推理时释放约6倍显存优势,同时保持90%-97.2%模型能力保留率。 官方指出,对移

2026-05-25 22:49:40  |  10 阅读
端侧AI新突破:国产技术实现手机运行大模型的高效压缩

端侧AI新突破:国产技术实现手机运行大模型的高效压缩

一个 8B 参数的大模型,通常需要约 16GB 显存。参数越多,越吃显存,这就是为什么,内存价格一天比一天高。 现在,有一种方法,可以省下 6 倍显存,却几乎不损耗模型性能。 过去两年,围绕这个看似极端的思路,一条全球性的技术竞赛正在成型。而就在这条赛道上,一个完全基于国产算力的方案,刚刚给出了自己的第一个回答。 模型被压到了不到 3B,同时,能力却可以保留 97%,甚至更进一步,如果结合 MoE 架构,未来可以直接在一部 8GB 内存的手机,运行 600 亿参数的大模型。 听上去匪夷所思,怎么做到的?

2026-05-25 22:44:42  |  13 阅读

面壁智能开源首个基于昇腾训练的1.58位端侧大模型

【TechWeb】5月25日,面壁智能联合清华大学、OpenBMB开源社区共同发布了其在低比特大模型训练领域的最新成果——BitCPM-CANN。这是国内首款完全基于华为昇腾算力平台实现的1.53位端侧大模型,该模型在技术上实现了重要突破。在相同设备配置下,该技术展示首次完成,随后已将其完整模型系列向公众开放。据公开信息显示,相比传统BF16精度,该模型在推理过程中节省了约6倍的显存资源,同时模型能力保持在90%至97.2%之间。在相同终端设备上运行时,可承载的模型能力大幅提升,过去需要1/6的内存即可获

2026-05-25 22:29:46  |  30 阅读

广西人工智能学院联手面壁智能举办大模型实战挑战赛

4 月 26 日,广西人工智能学院正式拉开帷幕,开展了聚焦大模型技术与 OpenClaw 应用的实战训练营及创新挑战赛。桂林电子科技大学校长助理王敬宇,以及来自广西人工智能学院、南宁职业技术大学、北京面壁智能科技有限责任公司等单位的related 负责人共同出席了此次活动。王敬宇指出,广西人工智能学院扎根广西、辐射东盟,致力于服务区域数字经济发展,始终将实践能力与创新精神的培养视为人才培育的核心。此次赛事通过与面壁智能及 OpenBMB 开源社区的深度协作,旨在推动学生从理论迈向实践,完成从技术“使用者”

2026-05-11 17:38:03  |  13 阅读

AI 早报:2026年4月9日

Meta 推出闭源大模型 Muse Spark。4月8日,该实验室发布新品,由前Scale AI CEO Alexandr Wang 领衔。该模型在算力大幅降低的情况下,实现了媲美 Llama 4 中型变体的性能,尤其在多模态和医疗领域表现优异。后续将融入 Meta 旗下社交生态,推动股价上涨 6.5%。智谱 AI GLM-5.1 开源登顶。4月8日,该模型开源,拥有 7540 亿参数。它支持长达 200K 的上下文窗口,在 SWE-bench Pro 测试中位列全球第三、国产及开源第一(超越 Claud

2026-04-09 22:01:40  |  15 阅读