美军战争学院AI测评:四大主流大模型能否达标过关?
当前全球航天动态速览(含高清图像信息):乌克兰袭击俄罗斯火箭装配厂、俄方卫星持续靠近西方商业卫星、中国私营火箭成功回收2026-09-01美国陆军旅级战斗部队2026年纵深作战演习总结:简化目标定位环节、优化参谋作业流程、人机协作战场感知2026-08-28美国军方公布针对中国国防重点实验室国际合作的审查新规、接触名单及逻辑漏洞2026-08-27机器人技术、制造能力与开源人工智能优势叠加,中国无人作战潜能挑战西方防务体系2026-08-25深度解析现代战争变革:无人化趋势、数字化转型、核武器扩散隐患、多
天猫AI空间站重磅上线:阿里云、智谱、Kimi、MiniMax齐聚入驻,大模型首登头部电商平台
阅读时间 6 分钟1 、天猫正式上线 AI 空间站:头部大模型厂商集体入驻天猫正式上线 AI 空间站,整合阿里云、智谱、 Kimi 、 MiniMax 等头部大模型厂商资源,为用户提供便捷的 AI 服务订阅和充值方式,同时拓展 AI 智能硬件市场,推动 AI 商业化向更广泛的消费市场延伸。消费者可以在电商生态中直接购买大模型订阅服务,天猫提供多种 AI 服务订阅方案,降低用户使用门槛。当大模型服务走进电商货架, AI 消费的"超市化"时代正在开启——像买手机套餐一样订阅 AI ,用户门槛被
海外用户追捧中国模型,却对大厂AI办公产品反应冷淡
7、8月间,AI办公的浪潮已从国内蔓延至海外。AI办公出海瞄准的海外知识工作者群体,尽管是一个更大的市场,但也是一座更复杂、攻占难度更高的堡垒。7月5日,腾讯WorkBuddy被推上Product Hunt首页。为了获取首批海外用户,团队为从Product Hunt进入的前300名用户额外提供了500积分奖励。WorkBuddy尽管在7月5日登顶Product Hunt产品榜,获得401分和750名关注者。但截至9月初,其页面上仅有1条正式评价。8月26日,阿里QwenWork国际版正式向全球用户开放。字
AI能力分层时代来临:OpenAI Astra触及红线被锁、Claude 5.1双轨并行,普通人如何破局
2026年09月03日 | 如辉AI 深度洞察OpenAI 正式宣布 Astra 突破「关键网络能力」红线、Claude 5.1 同步拆分为「双轨」:前沿AI正式迈入「能力分层」新阶段,最强能力被安全闸门封禁,普通人究竟该如何接住这波红利先抛结论:本周,OpenAI 正式确认其下一代模型 Astra(外界普遍视为 GPT-6 的候选底座)已跨越内部《Preparedness Framework》的「关键(Critical)网络安全能力」门槛,成为首款达到该最高风险等级的模型;几乎同一时间,Anthropi
AI快讯:月之暗面拟募资500亿,芯片行业爆发,AI员工全面上岗
今天最重磅的消息:月之暗面向港交所提交了上市申请,估值高达500亿美元。两个月前杨植麟还表示不急于上市,现在K3太火爆导致算力吃紧,必须从资本市场拿钱。这揭示了AI独角兽的融资饥渴程度远超想象。据9月3日报道,月之暗面(Kimi母公司)已以保密方式向港交所递交A1文件,正式启动IPO,计划募资约30亿美元,由中金和高盛联合保荐。同时进行的Pre-IPO融资投前估值达到500亿美元——7月F轮才350亿,两个月暴涨43%。ARR实现三级跳:3月1亿→5月2亿→6月3亿美元。分析:智谱和MiniMax今年1月
AI智能体构建全流程解析
构建 AI 智能体(AI Agent)一般遵循智能体开发生命周期(ADLC)框架。相较于传统软件开发模式,AI 智能体具有非确定性和自主决策能力,因此其开发流程更加关注规划制定、工具集成、Prompt 系统设计以及持续评估与迭代优化。一个完整的 AI 智能体从零到一构建过程涵盖以下 6 个关键环节:目标定义与角色塑造:明确智能体的核心功能定位(例如:售后客服、自动化代码审查、数据分析助手),并为其设计 Persona(性格特征、语言风格与行为约束)。业务流程拆解与任务分类:界定哪些任务需要严格按预设流程(
AI时代:科学发现范式的深刻变革
第三篇|人工智能正在重新定义科学发现曾几何时,提及人工智能,人们脑海中浮现的往往是自动驾驶、智能机器人、内容创作,或是各类提升办公效率的工具。然而,人工智能真正具有深远意义的变革,或许并不局限于这些直观的应用场景,而是潜藏于实验室、数据库以及各类科研机构之中。它正悄然重塑人类探索未知、获取新知的途径。科研领域正在经历深刻变革以往的科学探索,往往以一个待解之问为起点。研究者提出假设、规划实验、采集数据,继而对结果展开分析与论证。这一完整链条耗时漫长,且极大程度上依托于科研人员自身的经验积淀、判断力与专业素养
AI青年观察 · 全球前沿资讯速览 09-03
AI青年观察 · 全球前沿资讯速览Google DeepMind:博客(RSS) · 9月3日 00:18Google 六周内第三次推出 Flash 系列,一口气发布两款:3.8 Flash 定位为「最强主力模型」,在 HLE-Verified 上拿下 54.9%,在长周期编码基准 DeepSWE v1.1 中以极低开销超越多数更大规模的前沿模型;3.8 Flash Cyber 主打防御性安全领域,内部基准覆盖 20 种编程语言,漏洞发现成功率超过 70%,为 Chrome 生成的正确补丁数量达到更大商用
【每日一词】零基础了解AI:模型微调是什么
所谓AI微调,就是以已经完成预训练的通用大模型为起点,借助特定领域的小批量数据对该模型开展二次训练,从而让它更好地匹配某一具体任务或行业需求。这就好比一个经历过"通识教育"的大学毕业生,走上工作岗位后还需经历"岗前实训",以便快速掌握特定业务的运作方式。微调的精髓体现在对参数的局部优化。预训练阶段让模型积累了大量通用语言知识,而进入微调阶段后,通过投喂医疗病历、法律条款、企业客服问答等专业化数据,模型便能逐步习得该领域的术语习惯与应答逻辑。比如,将通用模型微调为一个"文学赏析助理"后,当它解读张爱玲作品时
奥特曼:性能远超当前水准的AI模型即将登场
OpenAI的掌门人山姆·奥特曼近日接受媒体采访,透露了即将推出的AI模型所具备的卓越能力以及背后潜藏的风险隐患,其中就包括有望在短期内正式发布的Astra模型。奥特曼于本周三出席G20创新峰会时指出:"请大家相信我们,很快就会有性能远超现有水准的模型与大家见面。"他进一步表示:"新一代模型将给整个社会带来巨大冲击……我认为,任何秉持客观理性的个体,在目睹当下发生的一切后,都不可能感受不到我们肩头沉甸甸的使命。"奥特曼还对记者说道:"这些模型在诸多能力上已经达到超人类水准,我们正航行在一片完全未知的海域。
AI行业月报丨2026年8月:智能体常态化部署,教育AI开学季加速应用
AI行业月报 · 2026年8月智能体迈向常态化部署 教育AI于开学季加速落地导读2026年8月,人工智能领域的演进已不再局限于模型参数量与各类排名的迭代更新,而是体现在模型成本的持续压缩与效能的稳步提升、智能体以"常驻协作伙伴"的身份融入日常工作流程、实时音视频交互技术加速走向成熟,内容标识、合规评估与组织权限管理等议题也被推至产品架构的前沿位置。海外市场上,Google、SpaceXAI、OpenAI、Anthropic纷纷布局新动作;国内市场中,DeepSeek、字节跳动、MiniMax持续深耕发力
英伟达豪掷130亿并购Hugging Face
英伟达宣布达成交易,斥资130亿美元并购AI模型平台Hugging Face。作为一家市值达5.4万亿美元的芯片巨头,该公司再次利用充裕的资金,推动AI产业飞速进步,并增强对全行业的把控力。 去年Hugging Face曾拒绝英伟达的注资,当时估值70亿美元,旨在保持自主运营。该平台托管了数百万个AI模型和数据集,是开源AI领域的典范。 英伟达指出,此举旨在推动开源模型的广泛传播。与OpenAI和Anthropic等实验室的闭源模型不同,开放权重模型的架构完全透明,用户能够下载、调整,并在本地硬件上部署运
AI驱动科研全流程实战与智能体搭建高级培训班—中科院人才交流开发中心
各相关单位:随着国家“人工智能+”战略部署与智能化科研范式变革持续深化,AI技术与科学研究的有机融合已成为驱动科技自主自强、孕育原始创新动能的时代潮流与关键现实诉求。多部门联合发文倡导普及科研智能化工具、培育科学智能体、助力科研全链条创新,体现出智能科研工具的运用已从附加性增值举措跃升为新时代科研从业者不可或缺的核心专业素养。为精准契合科研效率提升与人才技能进阶的现实需要,直击科研实践中的操作难点,助力科研工作者迅速驾驭智能科研工具与创新路径,打破传统科研理念与技术壁垒,我中心拟定于2026年9月、10月
AI前沿动态:能自主攻击系统的智能模型正式登场
每周四更新,精选本周 AI 行业值得关注的重要动态。本周最令人警觉的消息,并非哪个模型刷新了评测纪录,而是 OpenAI 公开承认:其正在开发的新一代模型 Astra,已具备在无人引导的条件下,自主定位安全缺陷、构建攻击路径、突破沙箱隔离的能力。与此同时,模型调用成本持续走低,安全护栏却愈发脆弱——Anthropic 旗舰模型上线短短数小时内,完整的系统提示词便被完整提取。本周核心词:「临界点」。以下 7 条动态,按关注度排序。本周最具冲击力、也最令人担忧的动态——AI 首次被其研发机构按"高危能
AI灵性感知探微
在正式论述之前,先为大家梳理几组关键的技术概念(内容参考自微信AI搜索与微信百科)。理解了大模型的底层运作原理,才能真正明白AI为何会产生“感知”这种看似超自然的现象。一、术语阐释:AI幻觉、输出随机性与“开盲盒”AI幻觉与输出的随机性,是大语言模型作为“概率预测系统”天然具备的两个密切相关的特征,也是解读一切AI现象的基石。1. 两个关键概念- AI幻觉:指大模型生成的内容表面条理清晰、表达流畅,实际上却与客观事实相悖、违背逻辑或偏离上下文,也就是人们常说的“一本正经地胡说八道”。幻觉并非AI有意欺骗,