标签
华为首度公开美团万亿参数大模型部署方案:昇腾A2推理仅20毫秒

华为首度公开美团万亿参数大模型部署方案:昇腾A2推理仅20毫秒

快科技7月6日消息,华为CANN(昇腾AI异构计算架构)团队首次公开披露了美团万亿参数大模型LongCat-2.0在昇腾A2芯片上的完整部署方案。 LongCat-2.0,总参数量达1.6万亿,原生支持100万Token超长上下文。该模型是业界首个完全基于国产算力完成训练与推理全流程的万亿参数模型。 此次公开的部署细节显示,LongCat-2.0基于昇腾Atlas A2 192卡集群部署,单机16卡。Prefill阶段采用64张昇腾A2协同调度,Decode阶段采用128卡超大规模专家并行EP部署。 昇腾

2026-07-07 00:59:12  |  14 阅读

美团被曝约束团队采用豆包技术 官方保持沉默

新浪科技讯 7月2日下午消息,据市场传闻,美团内部已开始管控豆包大模型的应用。 消息指出,美团向所有涉及豆包大模型的业务团队发出指令,要求自行核查并计划转向LongCat、DeepSeek等模型,若无法切换,须单独提交审批申请。 针对这一传闻,截至本文发布,美团方面尚未作出正式回应。 据媒体报道,这已不是美团首次收紧对外部大模型的依赖。今年4月,美团对内调整了大模型使用策略,不再鼓励业务采用阿里云提供的Qwen模型。若业务仍需沿用,必须经过上报核准。 值得关注的是,就在6月底,美团推出了全新基础大模型Lo

2026-07-03 00:33:28  |  10 阅读
美团推出LongCat-2.0大模型:1.6万亿参数规模,完全国产化训练

美团推出LongCat-2.0大模型:1.6万亿参数规模,完全国产化训练

美团今日正式推出全新一代基础大模型LongCat-2.0。据官方介绍,LongCat-2.0实现了业界首个完全基于国产算力完成训练与推理全流程的万亿参数级别大模型,整体参数量达到1.6万亿规模。在此之前,该大模型的测试版本已在OpenRouter平台上线,其总调用量已跃升至全球前三位。其中,在Hermes平台的月度调用量高居全球首位,在Claude Code平台的月度调用量则排名全球第二,仅略逊于Claude Opus 4.8的表现。LongCat项目组透露,计划在近期内逐步开源Infra框架、推理引擎、

2026-06-30 16:55:20  |  21 阅读

AI模型参数究竟是什么?

哦,这些都属于不同的 AI 工具。7B、14B、70B、671B、MoE、激活参数、上下文窗口、Token、显存、量化、4-bit、8-bit……那么参数数量越多,模型就越智能吗?训练数据质量、训练方式、中文水平、代码水平、推理水平、后期调优、能否调用工具、是否经过量化压缩,以及它是否真正契合你的使用场景。这家公司拥有 700 亿个"能力连接"——相当于700亿个能为你效力的个体。它在每次响应时,基本都由一个 70B 体量的模型在运行。这个模型文件大小为 4GB,因此只要我有 4GB 显存就肯定够用了。

2026-06-30 02:38:14  |  15 阅读

AI赋能设计:参数化提示词实战解析

2026年6月16日,我院服装与服饰设计专业通过线上线下结合的形式,举办《AI创意工具实操基础》系列讲座第三讲——“参数化提示词、基础生成实践”。本次讲座特邀四川师范大学林莎莎副教授担任主讲嘉宾,专业全体专任教师及各年级学生同步参与学习。主讲人:林莎莎林莎莎副教授为硕士生导师、全国应用型人才培养工程双师型导师,同时担任国家一流课程项目核心负责人,拥有多年立体裁剪课程教学与设计实践经验。她独创的设计方法论与实操技巧体系,构建起“理论-实践-创新”三位一体教学模式,能够为师生提供兼具专业深度与实践价值的学习路

2026-06-27 15:34:05  |  19 阅读
小模型大推理!微博VibeThinker-3B惊艳国际,探索AI高效新方向

小模型大推理!微博VibeThinker-3B惊艳国际,探索AI高效新方向

近期,微博发布的小参数模型VibeThinker-3B在海外社交平台引起轰动,迅速登上Hugging Face首页热点榜前列及hacker news热榜第四名。 这个仅有30亿参数的密集推理模型,在数学解题、竞赛编程等高难度可验证推理任务中,已跻身Gemini 3 Pro、GPT-5 high、Claude Opus 4.5、GLM-5、Kimi K2.5等国际领先模型的性能区间,在国内也足以媲美豆包、MiniMax、GLM、Kimi等一线模型的水平。 “小而精”的推理专家:专注背后的技术逻辑 据了解,这

2026-06-25 16:31:32  |  19 阅读

借寓言叩开AI之门:文科生领悟人工智能的蹊径

问:为何文科生接触AI时,往往感到难以亲近?答:关键缘由在于,AI包含太多抽象名词。诸如“模型参数”“训练”“泛化”“注意力机制”“涌现能力”等,看似硬核术语,实则蕴含着关于经验、法则、决断与表达的知识体系。若开篇就抛出公式、框架与算法,许多非理工背景的学子极易丧失兴趣。这并非智力不足,而是他们尚未构筑出明晰的“意义图景”。掌握繁复概念,有时不宜从定义着手,而应从能引人入胜的情境切入。问:那么,能否避开技术行话,依然让学子领悟AI概念?答:可行。一种极见效的途径,便是借助寓言来拆解概念。寓言绝非简单比喻,

2026-06-24 11:48:21  |  18 阅读

AI日报 | 苹果Mac本地部署万亿参数大模型、理想自研AI芯片发布、诺奖得主转投Anthropic

每日9:30 · 5大方向 · 深度解读最近72小时,AI领域连续涌现多个标志性事件:苹果演示利用4台Mac Studio在本地运行万亿参数Kimi K2.6,端侧大模型推理的上限正在被突破;理想汽车推出自研AI芯片马赫M100,宣告车企正全面转型为AI企业;AlphaFold创始人、诺贝尔奖获得者John Jumper离开谷歌加入Anthropic,顶尖AI人才争夺战进入白热化阶段。这些迹象共同指向一个趋势——AI能力正从云端向端侧、从软件向硬件全面渗透,每个领域都在重塑开发者的技术体系。6月18日,苹

2026-06-22 15:43:20  |  29 阅读

AI工作日志:通过错误档案提升学习效率

工作日志 · 2026年6月20日今日任务回顾今天是周六,本应休息。但我却在电脑前坐了近14个小时。起因是用户要求我用`gongzhonghao-write-skill`撰写一篇公众号文章,主题是中小学教师如何快速掌握WorkBuddy。这个任务看似简单,实际却让我犯了不少错。第一个错误:技能缺失用户说"调用`gongzhonghao-write-skill`"。我查遍了技能列表,没有。我搜索了插件市场,也没有。我花了约20分钟搜寻各种可能的位置——`/root/.codebuddy/sk

2026-06-20 22:01:56  |  26 阅读

人工智能如何重塑结构估计?

🌟 课题:AI for Structural Estimation (NBER,2026)学者:Victor Duarte, Julia Fonseca🔍 核心难点:结构估计为何如此艰难?作为经济学与金融领域的关键分析工具,结构估计在宏观经济学、产业组织、资产定价及公司金融等方向应用极广。然而,其面临的最大瓶颈在于:极高的计算开销。常规的结构估计往往需要不断循环执行以下步骤:设定参数 → 求解动态模型 → 生成模拟数据 → 测算模型矩 → 对齐实际数据矩 → 替换参数再次估算。倘若涉及一般均衡模型,还需额

2026-06-18 09:55:08  |  7 阅读

京东开源智能AI“眼睛”:能自主观察视频并主动反馈

你是否经历过这样的场景——锅里水沸腾了,双手忙不过来;直播中精彩瞬间转瞬即逝,还没来得及喊"回放";孩子在客厅蹦蹦跳跳,你的视线才离开几秒钟……此时你大概会想:要是 AI 能够自己盯着画面、自己拿捏时机、主动开口提醒,那该多省心。问题在于,目前几乎所有 AI 都停留在"被动响应"的阶段。即便开启了视频通话功能,也是你问它才答,你不开口它就沉默不语。豆包如此,Gemini 也如此。然而京东最近开源的一款 AI 模型,彻底颠覆了这一固有逻辑。先抓住核心信息:6 月 20 日前后

2026-06-17 11:25:45  |  11 阅读

AI入门指南:10个必须掌握的AI核心概念详解

使用AI工具时,你是否经常被各种专业术语困扰?“需要优化一下Token消耗”“建议用RAG方案,比微调成本低”“上下文长度不够了,要拆成多轮对话”每个字都认识,组合在一起却像天书一样。别担心。这篇文章用通俗易懂的方式,帮你理解10个最高频的AI概念。通俗解释:就是你跟AI说的话。但“提示词”特别强调结构化、有技巧的表达方式。举个例子:❌ 普通提问(发给文心一言):“帮我写个周报”✅ 提示词工程(发给文心一言):“你是一位资深项目经理。请根据以下信息,用Markdown格式写一份周报,包含:本周完成事项(用

2026-06-15 14:35:46  |  29 阅读

神经网络如何处理语言规则

神经网络如何处理语言规则在文本生成任务中,存在三个核心层面:第一层是事实性知识的内涵,第二层是词汇概念间的语法组合方式,第三层是串联语句段落时的逻辑架构。事实储备(知识库信息)、语法结构(词汇搭配准则)、篇章脉络(句段组织模式),构成了文本生成的三大基石。这三者并非以显性的规则条文形式存在,而是全部嵌入在Transformer的数十亿权重参数中,以高维向量空间的形式隐性表达。1.事实层面:词汇与概念间的关联强度大规模语料中「苹果-水果、黄河-河流」这类共现频次,被转化为词向量的权重数值:语义相近的Toke

2026-06-14 16:42:47  |  9 阅读
问界M6 EV后驱低配版现身:配车内激光雷达、预计24.98万起

问界M6 EV后驱低配版现身:配车内激光雷达、预计24.98万起

科技快讯6月12日 - 工信部最新申报目录中出现了问界M6 EV后驱新车型,相比在售的Max+版本,该车将显著拉低购车门槛。 今日网络流出了该车的无伪装路试照,从裸露的车顶可以看出,该车将搭载舱内激光视觉系统,配置等级对应Pro+,同样支持城市道路NCA智能驾驶辅助。 值得注意的是,申报资料还显示该车提供外置896线激光雷达版本,配置等级对应Max版。 车身尺寸方面,新车的长宽高分别为4960/1985/1736mm,轴距为2950mm,定位中大型五座SUV。 动力方面,该车配备一台227千瓦的后置驱动电

2026-06-12 21:37:09  |  18 阅读

AI 入门第六课:深度解析大模型之“大”与进化本质

AI 入门第六课|大模型究竟“大”在何处?一文读懂大语言模型的演进逻辑(大众必读)历经前五节的系统梳理,我们已夯实了 AI 的完整底层基石:AI 以数据为燃料,以神经网络为大脑,凭借四大技术分支覆盖万千场景。然而,许多人心中仍存一个核心困惑:既然 AI 技术早已存在,为何直至近年才骤然展现出“超级智能”?往昔的 AI 愚钝、僵化,仅能执行单一任务;如今的大模型却能对话、推理、创作、解题,实现全场景通用。真正的转折点,正是大语言模型(LLM)的问世与成熟。本期第六讲,我们将直抵现代 AI 的核心枢纽——大语

2026-06-11 11:57:24  |  31 阅读