标签

清华五道口AI快讯:微软转录升级、英伟达开源方案与收购Hugging Face

发布时间:2026-09-05 07:51阅读:2

大家好!这里是清华五道口AI俱乐部,每日为您呈现最新的AI行业动态。

微软推出顶尖转录AI:MAI-Transcribe-2发布,60种语言平均词错率仅5.2%

当地时间2026年9月3日,微软推出了新一代语音转文字模型MAI-Transcribe-2。在权威的多语言测试集FLEURS上,该模型在60种语言中的平均词错误率低至5.2%,在Gemini 3.1 Pro、GPT-Transcribe和Whisper v3-Large等主流竞品中表现突出。在速度上,它的转录速度比GPT-Transcribe快10倍,比Scribe v2快7倍,适合实时转录和大规模音频处理。功能上,它增加了说话人分离和逐词时间戳,可以清晰区分多位发言者并精确定位每个词的时间;支持两种转录风格切换、关键词优化、复杂噪音环境下的稳定转录以及中英文混合场景,进一步增强了其在会议记录、媒体制作和客户服务质检等领域的实用性。

谷歌发布WeatherNext 3,号称全球最精准气象模型,分辨率达5公里

当地时间2026年9月3日,谷歌DeepMind和Google Research发布了WeatherNext 3全球气象模型,声称它是最先进、最准确的。该模型直接从实时卫星观测数据中学习,每小时生成一次预报,地表分辨率为5公里,大气变量为25公里。它特别为风电(100米高度)和太阳能发电提供精准预测。该模型已集成到谷歌搜索、地图和Gemini等产品中,并为拉美、非洲和亚太地区提供高保真本地预报。

英伟达开源PAIR:本地运行AI的新方案,调度Mac/RTX PC进行跨设备推理

2026年9月3日,英伟达以开源测试版推出了Personal AI Router(PAIR)软件。该软件可以在局域网内自动发现兼容设备(M4及以上Mac、RTX PC、DGX Spark设备),为Ollama、LM Studio等本地AI工具提供统一的请求入口,将AI请求调度到空闲设备进行处理。测试表明,多设备协同工作可以将Qwen 3.6 35B A3B模型的多文档审查任务时间从18分钟缩短到8分48秒。

AMD发布Threadripper Halo Station工作站,支持T级模型本地运行

2026年9月4日,AMD在IFA 2026上发布了Threadripper Halo Station工作站,定位为“个人超级计算机”,支持本地运行参数超过1T的大型模型。工作站配备96核Threadripper PRO处理器、2块Instinct MI350P加速器和2TB系统内存,未来可扩展至4卡,HBM3E总容量为576GB,所有核心组件均采用液冷散热。

2026年9月4日,智谱AI宣布GLM Coding Plan推出“Flash×ZCode”夜间免费使用活动。从即日起到9月20日,付费用户在晚上11点到第二天9点通过ZCode使用GLM-5.3-Flash模型不消耗额度;通过其他Agent使用额度翻倍。GLM-5.3-Flash是GLM-5系列中的第一个原生多模态模型,曾以“Ox Alpha”匿名上线,现在在OpenRouter排名第一,使用量超过DeepSeek一倍以上。

2026年9月4日消息,微软计划从9月开始推送Copilot Studio更新,要求AI代理在执行特定工具调用前必须获得人工批准。开发者可以为每个工具和代理配置审批开关;如果启用审批,发送电子邮件、关闭工单或处理付款等操作需要代理等待用户批准才能继续。此功能旨在加强业务流程中的安全性和可控性。

2026年9月4日消息,Meta内部备忘录明确表示,工程师绩效评估将不再包括AI Token使用量或采用率仪表盘,而是侧重于工作质量和实际影响。目前Meta内部93%的代码变更由AI代理协助完成,但公司强调目标是高质量交付和快速迭代,而不是AI采用率本身。据披露,Meta内部AI使用量快速增长,预计今年的相关支出将达到数百亿美元。

2026年9月4日,英伟达宣布以约129.3亿美元收购开源AI平台Hugging Face。黄仁勋指出,Hugging Face拥有超过1800万开发者和300万个模型,英伟达是该平台的主要贡献者之一。收购旨在利用英伟达的基础设施将其扩展到前所未有的规模,并承诺保持开放平台属性,继续支持多模型、多云和多加速器环境,而不是将其变成仅服务于英伟达硬件的封闭入口。

以上就是今日AI快讯的全部内容,感谢您的收听。