标签

【AI快讯】洞察趋势,智领未来

发布时间:2026-08-03 18:04阅读:2

↑ 点击上方“甘肃交通科技通信”关注我们

OpenAI宣布将向10万名科研人员免费提供GPT-5.6系列模型。7月30日,美国AI公司OpenAI推出了“ChatGPT for Academic Researchers”计划,首期面向1万名科研人员,后续将扩容至10万名,免费提供ChatGPT高级功能。

谷歌DeepMind发布了具身推理模型Gemini Robotics ER 2。7月31日,该模型支持连续视频分析,能自动调整任务进度。在定位测试中,其准确率高达91.3%,平均时间误差仅为0.96秒。

印度Sarvam AI计划开发万亿参数级大模型。7月31日消息,该模型计划在六个月内完成,将应用于编程、网络安全和科学研究等领域,同时将在美国设立办公室以吸引印度裔专家回流。

韩国LG AI研究院发布了K-EXAONE 2.0模型。7月31日,该模型采用MoE架构,拥有750B总参数,在24项基准测试中平均得分70.1分。

日本Nextorage计划推出外接AI加速硬件aiDAPTIV Station。7月29日,该设备通过动态分配本机DRAM和外部NAND存储来扩容内存,使搭载32GB内存的笔记本电脑能够运行120B参数大模型。

DeepSeek V4-Flash正式版API已上线公测。7月31日,DeepSeek宣布V4-Flash大幅增强了Agent能力,在Terminal Bench 2.1测试中得分82.7,Cybergym测试得分76.7,并原生支持Responses API格式。

智元自研的WITA-Omni Preview全模态大模型以85.21分登顶DailyOmni榜单。7月28日消息,该模型在音视频联合理解和时序推理方面表现出色,在八项细分指标中赢得了六项第一。

华为开源了盘古5050亿参数MoE大模型openPangu-2.0-Pro。7月31日,该模型每Token激活约18B参数,支持512K上下文,采用DSA+SWA混合架构和4支流mHC拓扑结构,显著降低了长序列推理成本。

阿里推出了语音识别大模型Qwen-Audio-3.0-ASR-Flash。7月31日,该模型在上下文一致性、行业词识别和热词定制方面进行了优化,支持最长5分钟语音识别、离线文件转写和实时语音识别三种模式。

字节跳动发布了视频生成模型Seedance 2.5。7月31日,该模型可单次生成30秒高质量视频并支持多轮延长。它支持用户输入最多30张图片、10段视频和10段音频作为参考,并能同时还原多人同框场景中的形象与声音。