AI前沿速报|3分钟读懂人工智能领域最新进展(2026年9月5日)
据OpenAI官方博客及Axios于北京时间9月5日凌晨报道,OpenAI重磅推出全新旗舰产品GPT-6 Astra,并将其定位为"全球领先且高度对齐的智能模型"。最新测试中,该产品在FrontierMath Tier 4评测中斩获98%的高分,ARC-AGI-3测试中更是取得99.9%的惊人成绩,同时在ExploitBench基准测试中以满分100分完美收官,其网络安全性能已触及OpenAI Preparedness Framework所界定的"关键"级别门槛。OpenAI
人工智能每日资讯
动态:美东时间 9 月 3 日,OpenAI 推出全新旗舰模型 GPT-6 Astra,将其定位为“跨越式升级”。该模型依托得州 Stargate 设施,调用逾 10 万块 GPU 完成训练,着重强化软件开发、科学探索、逻辑推演、系统操控及信息安全方面的表现。核心功能:能够直接接入软件系统,独立处理编程开发、财务建模、PPT/表格制作、构建 3D 场景等耗时较长、环节繁多的复合型任务;在 OSWorld 2.0 基准测试中取得 72.6% 的成绩,完成任务所需时间较 GPT-5.6 Sol 缩短约 47%
AI前沿速递·0829 | 国产开源大模型密集发布,Agent迈入长驻运行时代
8月28日,腾讯推出并开源全新一代旗舰模型Hy4 preview:总参数量达770B、激活参数量49B,上下文窗口突破1M,采用Apache 2.0协议在Hugging Face、GitHub、ModelScope、GitCode同步开放模型权重。腾讯内部163名专家在203项工程任务盲评中为Hy4 preview打出2.99/4的均分,略胜于GLM-5.3与Kimi K3。定价延续亲民策略:输入6元/百万tokens、输出18元,已在WorkBuddy、元宝等产品中同步接入。值得关注:Hy4 previ
DeepSeek-V4-Pro-0813正式发布:百万级上下文与近40万输出,多项成绩领先Opus-4.8
新浪科技8月13日上午报道,DeepSeek官方API定价页面与文档更新显示,deepseek-v4-pro对应模型版本已升级为DeepSeek-V4-Pro-0813,意味着这款旗舰大模型从测试阶段迈入正式上线阶段。 根据官方定价页和文档说明,DeepSeek-V4-Pro-0813具备1M上下文窗口,单次最大输出量达384K Token,并同时兼容非思考与思考两种调用方式(默认为思考模式)。在超长代码库解析、海量文档研读以及需连续多步执行的智能体任务场景下,单次请求能够承载和产出的内容量显著提升,有效
当OpenAI与Anthropic竞逐顶级模型时,谷歌另辟蹊径:用低价AI智能体全面渗透
AI军备竞赛的核心议题,正从"谁更强大"转向"谁更具性价比"。谷歌三线并进:3.6 Flash(高效能) · Flash-Lite(大规模) · Flash Cyber(网络安全)01 / 三线并进:非价格之争,乃分层布局美东时间7月21日,谷歌一次性发布三款新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber。表面上看,这仅是一次常规的产品迭代。但深入分析其定价与定位,便会发现谷歌的打法与Ope
旗舰遇阻 Sonnet 5升级救急 性能媲美Opus
六月尾声,Anthropic 在官方网站发布了两则消息。 不同模型不同层级下的代理任务完成情况 Sonnet 5 与 Opus4.8 相差无几|图片来源:Anthropic 1 代理功能强化,Sonnet 5 逼近 Opus 先看 Sonnet 5 的数据。 在 SWE-bench Verified 这个评估编码能力的基准测试中,Sonnet 5 获得了 92.4% 的成绩。Anthropic 自家的 Opus 4.6 是 80.8%,OpenAI 的 GPT-5.4 为 57.7%。这是 Anthrop
OpenAI推GPT-6旗舰,英伟达发开源量子AI
中关村原创引擎2026.04.15———AI前沿动态.AI资讯 ————————»»»»全球每日人工智能前沿资讯2026.04.15今日热点导读OpenAI推出GPT-6旗舰大模型斯坦福:中美AI差距收窄至2.7%英伟达推出全球首个开源量子AI模型北京亦庄人形机器人半程马拉松4月19日开跑工信部发布“AI+质量”应用全景图银河通用Galbot入驻哈尔滨极地公园担任店员高德首款四足机器人预计即将发布德塔智能获超亿元融资,具备国家队背景菜鸟推出攀爬机器人ZeeBot半数AI医生平台提供误导性医学建议AI社交平