标签
美团推出LongCat-2.0大模型:1.6万亿参数规模,完全国产化训练

美团推出LongCat-2.0大模型:1.6万亿参数规模,完全国产化训练

美团今日正式推出全新一代基础大模型LongCat-2.0。据官方介绍,LongCat-2.0实现了业界首个完全基于国产算力完成训练与推理全流程的万亿参数级别大模型,整体参数量达到1.6万亿规模。在此之前,该大模型的测试版本已在OpenRouter平台上线,其总调用量已跃升至全球前三位。其中,在Hermes平台的月度调用量高居全球首位,在Claude Code平台的月度调用量则排名全球第二,仅略逊于Claude Opus 4.8的表现。LongCat项目组透露,计划在近期内逐步开源Infra框架、推理引擎、

2026-06-30 16:55:20  |  21 阅读
AI押注的德国队倒在世界杯首轮:一场技术预言的破灭

AI押注的德国队倒在世界杯首轮:一场技术预言的破灭

点球大战落幕的瞬间,德国队伫立场地中央,仿佛一部剧本中被仓促删除的关键角色。 就在数小时乃至数天前,它还沉浸在另一番叙事之中。这套叙事更为冷静、精致,恰似当下AI企业惯用的表达:数据、模型、Agent、概率修正、市场偏差。Kimi在世界杯开幕前将德国列为"潜力被低估"的选项。它指出,模型计算后德国夺冠概率约为11.3%,而部分市场隐含概率仅在7.4%上下。 这绝非草率的"德国必胜"断言。恰恰相反,它的表述相当审慎:非确定性结论,而是概率偏差;非预言,而是公开记录;非主观臆断,而是由300个子Agent从战

2026-06-30 16:33:02  |  9 阅读

银行AI转型:从可选工具到生存必需 竞争与规范同步推进

招商银行发布附带Token权益的信用卡,建设银行AI助手日均使用次数突破10万,工商银行AI数字员工年处理工作量达5.5万人年……这些数据和产品动态揭示,AI在银行业的地位已从后台支持转向前端业务和关键决策。在行业快速前进之际,首部系统性AI监管文件近日出台,为这场技术竞赛奠定了合规基础。 业内专家认为,这份指导文件弥补了金融领域AI全面监管的漏洞,建立了贯穿全过程的监管体系,标志着金融AI进入有章可循的规范化时代。展望将来,统一的监管规则有助于打造公平竞争的市场环境,保障金融消费者权益,为AI技术的长期

2026-06-30 16:32:04  |  33 阅读

AI实训第二周:B4大语言模型决策组件五大维度进阶实操

作者:xingwangzhe本文链接:https://xingwangzhe.fun/posts/ai-training-b4-llm-week2/[1]本文采用知识共享署名-非商业性使用-相同方式共享 4.0 国际许可协议[2]进行许可。前置声明:本图文存在AI辅助整理前文Day4 Proposal[3]中我详细分析了 B4 LLM 决策模块的设计方案本文在 Proposal的架构基础上,逐一攻克五个进阶要求,让一个 4B 小模型跑出了远超预期的工具调用能力。先回顾一下 B4 在 Agent 系统中的位

2026-06-30 16:19:56  |  23 阅读
世界杯冷门启示录:当12个AI模型同时看走眼

世界杯冷门启示录:当12个AI模型同时看走眼

德国队最后一个点球偏出球门线的那一刻,赛前那份预测表忽然变得格外刺目。在这份表格中,12个中国AI系统几乎没有给巴拉圭留下任何机会。DeepSeek、通义千问、智谱、讯飞星火全部预测德国3:0大胜;腾讯混元、Kimi、MiniMax、商汤小浣熊则给出德国3:1的判断;联想天禧AI预测2:1,百度文心、中移九天、阶跃星辰认为德国将以2:0轻松晋级。这是一份让人放心的预测。强队、巨星、战术体系、历史战绩、博彩赔率、公开数据,所有因素都指向德国。赛前看,它是一份稳健的共识;赛后看,它更像一份集体失灵的诊断报告。

2026-06-30 16:06:12  |  12 阅读

AI原生架构驱动智能客服升级实践

背景角色:金融客服升级(24.03-25.10),百万户/1.2万日交互/3.5k TPS。我任架构师,主导四层架构拆解、技术选型、算力调度、MLOps流水线与安全护栏落地。架构选型:四层解耦(接入/编排/模型数据/基础)。核心:AI内嵌/弹性/闭环/合规。技术:LoRA+QLoRA微调(+3参/<0.8损),BM25+向量+Cross-Encoder(RAG达91%),Milvus(HNSW),LangGraph编排(人机协同),自研AI网关(<15ms)。难点1(性能/成本):全量GPU贵

2026-06-30 16:00:42  |  14 阅读

华为正式开源openPangu-2.0-Flash模型,参数量达920亿

新浪科技讯 6月30日下午消息,华为今日宣布,正式开源上线盘古920亿参数级别的openPangu-2.0-Flash模型。 据介绍,华为开源AI模型品牌盘古openPangu,依托昇腾原生训练与推理技术,为业界用好昇腾提供实践参考,助力打造Agent时代的智能底座,加快人工智能商业创新和生态繁荣。 在此前的华为开发者大会HDC 2026主题演讲中,华为正式发布开源盘古openPangu 2.0。openPangu 2.0模型拥有512K上下文,包括Pro和Flash两个版本:2.0 Pro总参数量505

2026-06-30 15:49:16  |  16 阅读

华存案例 | 智谷方案破解AI大模型存储瓶颈,释放千卡集群算力

面对千亿参数大模型的训练挑战,存储系统需具备何种速度方能匹配GPU算力?某人工智能研究院在集群规模不断扩大的过程中,遭遇传统存储受限于以太网带宽、网络丢包及冷热数据统一存储成本高昂等难题,极易引发GPU算力闲置及训练任务中断。华存智谷助力该研究院成功落地训推大模型存储实践,采用高效分层数据存储方案。该方案基于TGStor 9800高性能并行文件系统与RoCE无损RDMA网络构建存算分离底座,利用HSM分层技术连通高性能存储与大容量对象存储,全面支撑大模型预训练、数据集处理及推理业务。目前,该方案已完成全流

2026-06-30 15:19:24  |  19 阅读

世润德造价+AI智能体参赛,公路整治管控系统引关注

世润德在工程造价领域深耕三十载,积累了丰富的业务数据与行业经验。近年来,随着AI技术成为生产力,我们结合专业技术与造价场景,围绕造价咨询全链条,依托大模型技术和世润德经验,全面拥抱“AI+造价工作流”,构建了涵盖:1、投资估算2、设计概算3、招标控制价4、施工图预算5、结算审核6、全过程造价管控7、专业类场景式AI等多个场景的AI智能体序列。近期,第二届综合交通运输大模型智能体创新应用大赛举办,该赛倡导“基础设施全生命周期数智化升级”,与我司“以AI重构造价工作流”的愿景高度一致。我们从第7项“专业场景类

2026-06-30 15:16:30  |  9 阅读

中科院人才中心开设AI赋能科研高级研修班,助力科研效率全面提升

写代码写到怀疑人生、数据多到处理不完、文献读到吐、绘图丑到被拒稿、本子改到麻木……这不是能力的问题,是工具代差的问题。"十五五"规划纲要更明确深化"人工智能+"行动,推动AI与科学研究深度融合。AI for Science正在打破传统科研边界,重塑科技创新发展体系。中国科学院人才交流开发中心将于2026年7月、8月、9月在北京、南京、成都举办三期"人工智能赋能科研实践效能提升与智能体构建应用"高级研修班。不讲理论,全程实操。专治科研"慢、乱、累"。13大模块,专为理工科科研定制的AI实战地图。科研主流大模

2026-06-30 14:23:05  |  20 阅读

揭秘AI瞬间把握核心的奥秘

揭秘AI瞬间把握核心的奥秘「猫没追上那只老鼠,因为它太慢了。」这里的「它」指的是猫还是老鼠?人类瞬间就能明白,AI凭什么也能理解?这靠的就是大名鼎鼎的「注意力机制」。AI 每处理一个词,都会回头审视整个句子,给其他词打分:跟我有多相关?越相关,就越「关注」它。 打个比方:就像你带着问题在一堆资料中搜索。你的问题是Query,资料的标签是Key,匹配上了就把对应的Value提取出来。 那「相不相关」怎么判断?把两个词的数字向量对应位相乘再相加(这步叫点积),得数越大,两个词就越匹配,注意力分配得越多。 这个

2026-06-30 14:16:00  |  28 阅读

人工智能未来发展趋势与行业前景展望

人工智能拥有极为广阔的发展空间,正逐步成为推动第四次工业革命的关键驱动力。2026年被视作AI由技术变革迈入产业变革的重要转折节点,整个行业正经历从"能对话"(生成式AI)到"能执行"(智能体AI)的关键升级阶段。从市场体量来看,2025年全球AI市场总规模已超过3000亿美元,预测2026年将突破9000亿美元;中国AI核心产业规模预计2026年有望达到1.2万亿元,相关企业数量超过6000家,稳居全球领先位置。中国实体经济领域的AI渗透率约为10%,增长潜力巨大。工业企业在应用大模型及智能体方面的比例

2026-06-30 13:00:55  |  99 阅读

深度拆解:AI大模型的底层认知逻辑

近年来,“人工智能大模型”已成为各领域关注的焦点,几乎人人都在讨论这一概念。为帮助普通大众跨越专业门槛,真正理解人工智能大模型的核心内涵,本文将从基础的建模与模型概念出发,逐步厘清机理模型与概率模型的本质差异,最终用通俗的语言和生活化的视角,深入剖析人工智能大模型的根本原理,让复杂的底层逻辑变得清晰易懂。一、建模与模型人类认识自然、改造世界、钻研科学的根本路径,本质上就是发现规律、提炼规律、运用规律的过程。而建模,正是人类总结客观世界运行法则最核心、最科学的途径。所谓建模,简而言之就是:面对自然界纷繁复杂

2026-06-30 12:36:05  |  6 阅读

AI转型投入无果?四策破解90%弯路

点击蓝字,关注我们企业AI转型,投入了却未见成效?四大破局策略助你规避九成弯路!企业AI生态体系的重塑中关村科学城“科创人才”夜校——企业家大讲堂渴望应用AI,却担忧资金浪费无回报?引入大模型后,却发现其无法理解核心业务逻辑?无需焦虑。6月17日,在中关村科学城党群服务中心,中关村科学城夜校“企业家大讲堂”揭晓了答案。现场座无虚席,线上参与人数突破一万。作为港股“企业大模型第一股”的滴普科技创始人、董事会主席、执行董事兼CEO,赵杰辉精准剖析了企业AI落地面临的三大“障碍”。——三大障碍01FUTURET

2026-06-30 12:24:44  |  119 阅读

美国单边管制如何搅乱全球AI格局

人工智能已不再是单纯的技术竞赛,而是大国地缘博弈的核心阵地。近期英国皇家联合军种研究所(RUSI)发布分析评论,以美国商务部强制AI企业Anthropic暂停海外用户访问Fable 5、Mythos 5两大前沿AI模型事件为典型案例,深入剖析美国正在推进的AI安全化策略——以国家安全为借口实施单边技术封锁,这种管控模式正重塑全球AI发展格局,埋下难以逆转的全球技术分裂隐患。2026年6月12日,美国商务部正式致函AI企业Anthropic,发出极具冲击力的出口管制指令:要求企业立即暂停所有外籍人员(无论身

2026-06-30 11:20:53  |  17 阅读