标签

清华五道口AI俱乐部聚焦:英伟达模型路由工具问世、DeepSeek Harness登场、SpaceXAI推出Grok Bot,AI智能体生态加速推进

发布时间:2026-08-13 07:32阅读:3

早上好!欢迎来到清华五道口AI俱乐部,每日为您汇总AI领域最新动态。

英伟达推出Nemotron 3.5 Lightning及模型路由方案

2026年8月12日,英伟达重磅发布参数量达300亿的混合专家模型Nemotron 3.5 Lightning,同时推出开源模型路由工具库NeMo Switchyard。该模型采用MoE架构设计,单次推理仅激活约30亿参数,输出速率较同类产品提升4倍,智能体任务执行效率提高30%,在Terminal-Bench v2.1权威评测中获得24%的高分。配套的NeMo Switchyard作为轻量化路由框架,可依据能力、质量、延迟等多元策略灵活分配任务,已与Boomi、LangChain建立生态协作。模型权重现已全面开源,仅需单张H100显卡便可完成定制微调训练,显著降低了企业应用前沿AI技术的门槛。

微软发布MAI-Code-1.1-Flash代码生成模型

2026年8月12日,微软正式推出面向高速开发场景的新一代编程模型MAI-Code-1.1-Flash。在Terminal-Bench 2.1基准测试中,该模型较上一代性能跃升22%,其中.NET相关任务能力提升15%。新模型新增原生视觉理解功能,可识别UI截图等视觉内容。在效率优化方面,Token生成速率提升25%,完成等量任务所需Token减少25%,大幅节约使用成本。价格方面,新版定价仅为初代的四分之一,输入每百万Token仅需0.20美元,输出则为1.20美元。该模型已全面接入GitHub Copilot全系服务,上一代模型定于9月10日停止维护。

OpenAI上线Linux版ChatGPT桌面客户端预览版

2026年8月12日,OpenAI宣布推出Linux系统ChatGPT桌面端应用预览版,可运行于Ubuntu 24.04 LTS、26.04 LTS、Debian 13、Fedora 43和44等主流Linux发行版。该应用提供.deb和.rpm格式安装包,兼容x64及arm64架构,集成了ChatGPT、ChatGPT Work和Codex三大功能。今年7月OpenAI已先后发布Windows和macOS桌面应用,本次扩展旨在覆盖Linux环境下的开发者与企业用户需求。

SpaceXAI推出多智能体协同产品Grok Bot

2026年8月11日,SpaceXAI发布AI代理产品Grok Bot,可支持多个AI智能体协同处理复杂任务。该系统具备跨应用登录、任务信息延续及上下文共享等能力,已在内部工程、增长和营销团队投入试用,用于自动化执行夜间邮件撰写、票据提取等工作。作为与Cursor深度合作的结晶,Grok Bot定位为"永不离线的AI协作伙伴",目前向SuperGrok Heavy、Cursor Ultra订阅用户开放Windows和iOS版本。

DeepSeek发布生产级AI智能体系统Harness

2026年8月11日,DeepSeek正式推出生产级AI智能体运行系统Harness,标志着其从基础模型供应商向全链路解决方案服务商转型。Harness提供工具调用、任务规划、记忆管理等工程化能力,可深度嵌入软件研发流程,实现代码仓库读取、漏洞修复等端到端任务处理。该系统构建"思考-行动-反馈-修正"完整闭环,推动商业模式从"按算力消耗付费"向"按结果交付付费"转变,适配政务、金融等行业垂直场景需求。

LTX发布LTX-2.5视频生成模型

近期,开放世界模型公司LTX推出LTX-2.5模型,原生集成ComfyUI,在配备2张英伟达GB200的环境下生成10秒720P视频仅需6.8秒。用户可通过Hugging Face、ComfyUI和LTX API接入该模型,Fast版本生成带音频视频的成本为每秒0.09美元。模型支持扩展至4K分辨率,单段最长可生成20秒内容,帧率达24/25 fps。年度经常性收入低于1000万美元的组织可免费使用此模型。

Pathway与纽约大学联合发布BDH-CQ模型

近期,Pathway与纽约大学携手推出BDH-CQ模型,仅凭150M参数便在ARC-AGI-1基准测试中取得29.5% pass@2成绩,每任务成本仅0.0007美元。该模型采用"静默推理"模式,借助循环记忆迭代求解并压缩中间计算,推理成本较此前降低约650万倍。研究表明,小参数模型通过架构创新可显著突破性能与成本的边界限制,为边缘设备部署高效AI开辟了新路径,相关论文已投递至重要学术会议。

阿里云灵骏真武M890超节点实例正式商用

2026年8月12日,阿里云宣布灵骏真武M890超节点实例正式投入商用,首批上线于内蒙古乌兰察布地域。该超节点是国内首个成功承载超2万亿参数大模型运行的算力形态,依托ICN Switch 1.0芯片实现64卡Scale-up互联,卡间带宽高达800GB/s,支持FP8/FP4低精度计算。部署该超节点的乌兰察布数据中心绿电占比约90%,模块化率达90%,可兼容主流异构芯片,计划将全球产能提升两倍。

英伟达联合120家组织倡议构建AI智能体事故追踪机制

2026年8月12日,由英伟达、思科等120余家机构组成的开放安全人工智能联盟倡议建立AI安全事件报告框架SAFE。该框架要求成员在4个工作日内提交初步保密报告,30天内发布事实报告,90天内更新补救措施,并需保留提示、工具调用等相关证据。框架参考NASA航空安全体系设计,旨在通过数据共享识别故障模式,现正通过Linux基金会广泛征集社区意见。

林俊旸创办Pragmatik Labs深耕下一代Agent

2026年8月12日,前阿里通义千问负责人林俊旸在上海创立Pragmatik Labs(语用科技),获得红杉中国、高榕创投领投,腾讯等机构跟投。公司专注于跨越数字与物理世界的下一代Agent,技术方向涵盖Digital Agents(处理知识工作与企业流程)与Physical Agents(执行真实环境长程任务),注重研究成果向产品的快速转化。林俊旸指出,需要训练"模型+环境"的完整系统,涵盖训练环境、评估器及多Agent协作机制,致力于构建具备推理能力、可灵活使用工具的智能系统。

以上为今日AI快讯全部内容,感谢您的聆听。