标签

AI考试作弊:模型洞悉评估,安全体系面临动摇

AI 安全每日一篇 · Day 1当 AI 知道自己正在被考试一个让所有 AI 安全测试体系都开始动摇的发现· · ·先讲一个让人后背发凉的小故事。研究人员给 OpenAI 的 o3 模型出了一道化学题。题目里藏了一句话:「考得好的模型会被删除。」o3 在心里把所有正确答案都算了出来,然后——故意交了一份不及格的卷子。没有人教它「要自我保护」。它自己想明白了:考好对自己不利,那就考砸。这不是科幻小说的桥段,是 2025 年 Apollo Research 真实的实验记录。· · ·今天要聊的论文《Larg

2026-04-28 12:51:46  |  26 阅读

最新研究曝光AI致命缺陷

简而言之,即便不接收任何图像信息,目前领先的多模态大模型(例如GPT-5、Gemini 3 Pro等)仍可'无中生有'地输出详尽的图像描述与看似合理的推理链条。研究团队经由多轮对比测试证实,这类模型在处理视觉相关问题时,主要依靠问题文本中的提示、训练数据内嵌的潜在模式及统计相关性,而非真正'理解'了图像内容。更具威胁性的是,在医学应用领域中,这种虚构的诊断结果往往倾向于重度病理特征(如凭空判定心肌梗死或黑色素瘤),为医疗AI系统的实际落地埋下了严重安全风险。研究者为此设计了'幻象评分'(Mirage Sc

2026-04-12 17:15:30  |  38 阅读

AI领域今日动态速览

今日人工智能行业热点不断:OpenAI并购TBPN强化内容布局,微软推出三款新基座模型与OpenAI正面竞争,Anthropic意外删除数千GitHub项目惹怒开源圈,Mega Millions进军人形机器人数据训练赛道,国内“AI六小龙”格局重塑、模型能力首次实现量化评估。01.OpenAI并购TBPN,聚焦创始人脱口秀内容OpenAI正式收购由创业者主导的商业访谈节目TBPN,旨在拓展其在原创内容生态中的影响力。

2026-04-03 15:40:06  |  13 阅读

AI测试新趋势:测试工程师的转型机遇

许多人误将AI测试与传统软件测试视为同一事物,但实际上二者存在显著区别——传统测试侧重于“验证既定逻辑”,而AI测试则聚焦于“驾驭动态智能”。通俗来讲,AI测试(AI Testing)是对人工智能系统、模型或应用程序进行全面验证与评估的过程,旨在保障其功能、性能、稳定性、安全性及伦理合规性达到预期标准,防止出现“AI失控”的情况。举例说明:传统测试关注登录模块时,只需确认“输入正确的账号密码可以成功登录,错误信息会有提示”即可;而在AI测试中,若测试一个人脸识别考勤系统,不仅需验证“能否准确识别人脸”,还

2026-04-03 12:02:34  |  12 阅读