面壁智能开源ForgeTrain:全球首款AI自研生产级训练框架
AI能否独立编写出真正达到生产标准的大型软件,甚至是大模型训练框架?面壁智能给出了肯定的回答:完全可以。今日,由中关村科学城公司投资的面壁智能携手清华大学及OpenBMB开源社区,正式推出了ForgeTrain。这是全球第一款完全由AI代码生成、无需人工介入的生产级大模型训练框架。它并非实验性的原型机,而是一套能够直接投入商用、创造实际价值的「AI引擎」。在英伟达H100 GPU环境下,ForgeTrain的训练效率比英伟达自研且业界通用的Megatron框架高出10%。这意味着在相同任务场景下,可直接节
AI自主构建AI:技术闭环的起点
↓↓↓点赞、转发、关注、获取更多AI实战干货!↓↓↓最近我注意到,AI领域发生了一件令人深思的事。不是因为某个模型性能提升,而是一个完整的自动化流程在2026年5月26日被一家中国公司悄然实现。事件核心非常清晰:执行方:面壁智能,联合清华大学与OpenBMB开源社区。成果内容:推出了端侧大模型MiniCPM5-1B,并开放了其训练框架ForgeTrain的源码。(AI独立造出了AI)最引人注目的地方在于ForgeTrain这套框架——这些代码完全由AI自动生成,而该框架又成功训练出新的AI模型。这个过程让
群核科技早盘飙升超15% 开源3D高斯浏览器Aholo Viewer
立足香港,放眼世界。新浪财经全球资本峰会金曜奖投票启动!挖掘最具价值的资本力量,你的一票,至关重要 点击投票 群核科技(00068)盘中涨幅突破20%,截稿时股价上涨15.20%,报21.98港元,成交额达3.71亿港元。 近日,群核科技正式宣布开源3D高斯浏览器Aholo Viewer。该产品全面适配手机、电脑、VR设备等各类终端,用户无需安装客户端,只需打开浏览器,即可流畅浏览包含超10亿高斯点的城市级超大3D场景。 国泰海通(13.14, -0.06, -0.46%)证券发布研报称,群核科技作为国内
小米大模型开启永久降价模式,最大优惠高达 99%
作者 | 李香香 编辑 | 叶映橙 5 月 27 日,小米旗下的 MiMo 大模型团队正式发布公告,宣布对 V2.5 系列模型的 API 实施永久性价格下调,最大降幅达到 99%,且不再根据上下文窗口长度进行区分。与此同时,团队还优化了 Token Plan 计费机制,在相同价格下,用户的使用量可提升至原有的 5 到 8 倍。此后,雷军转发了该消息并给出了内容一致的回应。 小米技术官方微博指出,此次调价得益于团队在推理系统层面的不断精进。通过 SGLang HiCache 全面支持 SWA(滑动窗口注意力
AI驱动职业发展!2026年OpenClaw实战课程来袭,打造专属AI工作流!16岁+可报名
2026年,AI智能体领域迎来全面井喷!OpenClaw(AI龙虾)超越Linux成为引爆话题的开源项目。"人工智能+"战略推进,预计2030年智能终端、智能体等覆盖率将超90%!各地纷纷推出政策扶持open claw和opc发展,最高给予千万级资金奖励。当前OpenClaw应用量激增,推动千亿美元级别的AI算力市场增长。行业人才缺口巨大,企业高薪争夺具备AI应用能力的人才。掌握AI工具的专业人才将成为职场新宠!注:文中数据
开源维护者在 AI 浪潮下的生存挑战
Cobra[1] 目前积压了 243 个未决 issue 和 118 个待处理的拉取请求,而 Afero[2] 也有 114 个 issue 及 55 个 PR 悬而未决。Cobra 作为底层支撑,服务于 kubectl、GitHub CLI、Hugo[3] 等成千上万的工具。当你执行 kubectl get pods 或 gh pr list 时,背后都是 Cobra 在解析指令。Afero 则深深嵌入 Hugo、Cobra 本身以及无数其他项目中。若在 Cobra 上草率合并代码,可能摧毁整个 Kub
MiniCPM5-1B:重塑端侧AI智能密度新高度
2026年5月26日,面壁智能携手清华大学及OpenBMB开源社区,共同推出面向端侧部署的文本基座大模型 MiniCPM5-1B。该模型参数量为1B,专为终端设备场景设计。依据官方公布数据,MiniCPM5-1B 在 Artificial Analysis(AA)榜单中斩获17.9分,在2B以下开源模型中表现优异。相比之下,Qwen3.5-2B 得分为16.3分。在知识问答、数学推理、代码生成及工具调用等评测维度上,MiniCPM5-1B 相较于 Qwen3.5-0.8B、LFM2.5-1.2B-Thin
清华五道口AI速递 | 多款大模型齐发,端侧AI密集落地,人形机器人同步更新
各位早安!欢迎收听清华五道口AI速递,每日为您梳理AI领域最新动态。OpenAI GPT-5.6意外泄露:上下文窗口扩至150万token,预计6月亮相2026年5月26日,多位开发者在OpenAI Codex后端日志中发现了尚未公开的下一代模型线索,内部代号为“iris-alpha”,外界猜测即为GPT-5.6。该模型最大亮点在于上下文窗口从GPT-5.5的105万token大幅提升至150万token,增幅约43%,可更高效处理超长文档、大型代码库及复杂多步骤任务。测试表明,即使输入超过90万toke
AI 自训模型问世!面壁小钢炮成本降一成,性能碾压同尺寸竞品
面壁智能最新一代“小钢炮”正式亮相。5 月 25 日,面壁智能携手清华大学及 OpenBMB 开源社区,共同推出了 MiniCPM5-1B。该模型仅含 1B(10 亿)参数,却在权威评测榜 Artificial Analysis(AA)上斩获 17.9 分的高分,一举超越所有参数量在 2B 以下的模型,即便是参数翻倍的 Qwen3.5-2B 也甘拜下风。更小却更强,这再次印证了面壁曾发表于 Nature 的密度定律:大模型的智能密度大约每 3.5 个月就能翻一番。面壁“小钢炮”系列模型向来以参数小巧、能量
AI 日报 | 5 月 26 日重磅:苹果 1.2T 重塑 Siri,GPT-5.6 六月将至,谷歌破解 56 年数学困局
AI 日报 | 2026 年 5 月 26 日:苹果 1.2T 参数模型重塑 Siri,GPT-5.6 六月登场,谷歌 AI 突破 56 年数学难题今日 AI 领域消息铺天盖地。苹果推出基于 1.2T 参数的定制版 Google 模型以重塑 Siri,OpenAI GPT-5.6 提前曝光——拥有 150 万 token 上下文窗口,Anthropic 新模型令欧洲央行紧急召开安全会议,谷歌 AlphaProof Nexus 成功破解两道悬置 56 年的数学题。大模型军备竞赛全面升级,竞争愈发激烈。面壁智
六月香江论道:开源AI智能体如何重塑企业生产力
企业天天谈论 AI 智能体(Agentic AI),究竟如何真正融入日常运营?又该如何借助这项技术降低技术门槛,实现「单兵作战」的极致效能?🔥Opensource AI Agentic Forum 开源 AI 智能体论坛汇聚了中国最顶尖的开源 AI 技术专家与行业领袖。从底层生态架构到真实产业落地路径,为您深度剖析企业应用 Agentic AI 的制胜之道。这是一次与内地顶尖 AI 专家直接交流学习的绝佳机会!🧠💡📅 日期:2026 年 6 月 4 日(星期四)⏰ 时间:14:15 - 15:45📍 地点
开源证券重申买入哔哩哔哩:新游与AI双引擎助推
立足香港,放眼世界。新浪财经全球资本峰会金曜奖投票启动!挖掘最具价值的资本力量,你的一票,至关重要 点击投票 开源证券发布研报指出,哔哩哔哩-W(136.4, -1.70, -1.23%)(09626)毛利率已连续15个季度实现环比增长,一季度达到37.1%(同比增长0.9个百分点,环比增长0.1个百分点)。报告看好AI技术对平台发展的赋能作用,并认为新游戏的推出将驱动业绩成长,维持对2026至2028年归母净利润15.74亿/24.86亿/33.07亿元的预测,当前股价对应市盈率分别为32.0/20.3
昇腾鲲鹏技术革新,开发者规模突破415万
新浪科技讯 5 月 26 日上午报道,在近期举办的鲲鹏昇腾开发者大会 2026 上,多项涉及昇腾与鲲鹏的创新成果正式亮相,内容囊括超节点架构的革新、软件生态的开源开放以及易用性的持续优化等。 聚焦 AI 计算范畴,昇腾超节点与 Agent 负载具有天然契合度,正引领算力基建的新模式。华为公司 Fellow、半导体首席科学家廖恒在题为《面向 Agentic AI 时代的昇腾超节点最佳实践》的演讲中指出:昇腾始终遵循从“芯片架构到系统架构,再到集群与软件架构”的深度协同策略,不断迭代硬件实力、优化 CANN
开源速递:专为 AI Agent 打造的安全技能库
Anthropic-Cybersecurity-Skills:汇聚 754 项结构化网络安全技能,涵盖安全分析、紧急响应、威胁猎捕、云端防护及恶意代码解析等多个领域。Anthropic-Cybersecurity-Skills 是一个专为 AI 智能体设计的网络安全技能集合,重点梳理了安全分析、应急响应、威胁狩猎、云安全以及恶意软件分析等场景下的标准操作流程。项目链接https://github.com/mukul975/Anthropic-Cybersecurity-Skills该仓库目前收录了 754
AI公司如何通过开源模型盈利?
最近关于大模型开源与闭源的消息频出,你是否也有类似疑问:随着越来越多的AI模型选择开源——参数公开、可免费下载甚至支持商用,那么这些开发AI模型的企业究竟如何维系运营?本文将探讨AI企业的盈利方式。目前来看,开源模式主要有三种不同的路径。闭源模型(如GPT-4、Claude):类似可口可乐的秘方,只能通过API调用,按使用量计费,不公开模型细节。开源模型(如DeepSeek、Llama):就像公开的菜谱,用户可以自由下载代码和参数,并在自己的硬件上运行或进行修改。过去,开源模型在性能上可能稍显逊色,价格便