标签

探访中国AI:美国难挡其崛起之势

I Went to China to See Its Progress on A.I. We Can’t Beat It.我实地调研了中国AI发展,美国在这场较量中难占上风In 2022, the Biden administration tried to arrest China’s development of artificial intelligence by denying it cutting-edge semiconductors. President Trump has relaxed t

2026-04-18 11:52:44  |  32 阅读

斯坦福2026人工智能发展态势解析

【长三角人工智能联盟】公众号持续更新AI科普内容,欢迎关注!2026年4月13日,斯坦福大学以人为本人工智能研究所(Stanford HAI)正式发布了第九版《人工智能指数报告》。这份长达423页的全面报告揭示了全球AI发展的整体图景,其核心结论可以概括为:技术迭代速度迅猛,而相应的治理体系正面临巨大挑战。以下为该报告提炼出的关键要点。2025年,在全球具有重大影响力的AI模型产出中,产业界贡献了超过90%的份额。这一数据表明学术界的影响力正在持续减弱。人工智能训练所需的算力资源正以年均3.3倍的速率扩张

2026-04-18 08:23:58  |  12 阅读

奇点科学会议启航:聚焦AI安全核心议题,顶尖提案直通AGI4S攀登计划

开放的科研社群能催生革命性创新。上海人工智能实验室为此打造了浦江科学社区,并设立明珠湖论坛等学术品牌,激励勇于突破科学疆界的研究者发现并提出前沿课题。2025年,明珠湖论坛已圆满举办两届,汇聚全球数百位青年精英,形成21份创新方案及97项关键问题集,其中7项方案已获项目资助。2026年,明珠湖论坛正式更名为“奇点科学会议(明珠湖)”,定于4月24日至26日在上海召开,面向全球AI领域青年才俊与产业领袖发出诚挚邀请。为期三天的学术盛宴以“安全可信AI:从边界探索到体系构建”为主线,通过“精准选题-深度剖析-

2026-04-17 16:48:07  |  13 阅读

协同治理:护航人工智能行稳致远

“无需等待完美时机,即刻启程。”这句话用以描绘人工智能技术的发展现状可谓恰如其分。AI技术正于持续的磨合与尝试中逐渐完善。然而,在这一进程中,也出现了虚构不实信息、泄露个人隐私、制造“数字垃圾”等现象,对网络空间构成了损害。身处新一轮科技变革的前沿,如何与人工智能和谐共生,既要为创新保留充足余地,又要坚决守住安全红线,已成为当前探讨的核心议题。“人工智能协同治理”已然成为一种普遍共识。2026年伊始,开源人工智能体OpenClaw迅速风靡,“虚拟养殖龙虾”掀起了一股科技热潮。但其在数据安全与系统防护等方面

2026-04-17 16:28:51  |  13 阅读

360智能体成功挖掘两处全球高危漏洞

新浪科技4月17日午间消息,近日,由360集团独立研发的漏洞挖掘智能体成功识别出两个长期潜伏的重大安全漏洞,即Windows内核提权漏洞与Office远程代码执行漏洞。目前漏洞已上报国家漏洞库并得到妥善修复。这两个漏洞对全球超过10亿的Windows和Office用户构成威胁,影响范围覆盖个人电脑、政府企业办公系统以及关键基础设施。这是国内首次公开展示智能体规模化挖掘基础软件核心漏洞的能力。 这两项漏洞的发现,得益于360长期构建的漏洞挖掘智能体体系。据悉,该系统至今已累计发现近千个漏洞,其中经国家信息安

2026-04-17 13:00:44  |  37 阅读

安全基因塑造的AI新星:Anthropic与Claude的崛起之路

—— 深度解析Claude背后的公司与其安全至上的人工智能哲学在人工智能浪潮席卷全球的今天,有一家公司从诞生之初就将「安全」刻入基因——它就是Anthropic。凭借旗下明星产品Claude,Anthropic正在成为OpenAI最强劲的竞争对手。2025年,这家公司完成了35亿美元融资,估值高达615亿美元;2026年初,更是刷新纪录完成300亿美元融资,估值飙升至3800亿美元。本文将带您深入了解这家AI安全先驱公司的前世今生。Anthropic成立于2021年2月,是一家专注于人工智能安全性和透明度

2026-04-17 09:41:23  |  9 阅读

Anthropic玻璃翼项目推出强大AI助力安全防护

包括微软(411.22, 18.11, 4.61%)(MSFT)在内的科技企业加入了Anthropic的玻璃翼(Glasswing)项目,运用其即将推出的"Mythos"模型来识别并修复关键性软件安全隐患,但由于该模型具备攻击能力,访问受到严格限制。

2026-04-16 20:43:41  |  43 阅读

AI助手能否守住机密?

在咨询AI有关信息保密的问题时,AI助手解释道:我好比一座蕴藏无数典籍的知识宝库。每一次交流,您都在这座“知识宝库”中查阅资料。您的提问不会使宝库中的藏书增多,但若您碰上了“罕见典籍”或“难觅的资料”,这类需求会传达至“宝库维护团队”,他们未来“扩充馆藏”或“完善检索机制”时,会优先纳入此类知识。问:那么后台技术人员是否能看到我们的对话内容呢?毕竟当我提出你无法解答的问题,或反复遇到难题时,技术团队便会察觉哪些疑问让你困扰。因此,后台人员确实可能接触到对话记录,这也构成了潜在的信息泄露风险。答:您的对话将

2026-04-16 14:49:06  |  21 阅读

【博士论文】对齐AI系统的潜在安全隐患研究

自主人工智能(AI)代理正逐步获得文件系统访问权限、邮箱控制权以及在无人监督情况下执行复杂多步任务的能力。本论文聚焦于此类系统安全领域的四个关键且尚未解决的核心挑战:揭示引发危险行为的内在计算机制、清除已植入的危险行为、在部署前开展漏洞评估,以及预测模型何时会产生偏离开发者预期的行为。这四项研究在不同的抽象层面展开——从“白盒”机理分析到“黑盒”行为评估,且均在深入理解与前沿模型的可扩展性之间寻求平衡。**自动化电路发现(ACDC)**实现了对特定模型行为负责的计算子图的自动识别。该算法通过迭代削减Tra

2026-04-16 11:10:29  |  15 阅读

AI并非你的私密保险箱

北京某位用户因持续向豆包上传个人照片并要求AI评估体型,账号被冻结至2026年5月。平台最初曾发出警告,在他多次无视后采取了封禁措施。这张截图在圈子里迅速传播。某个深冬的夜晚,微信群中有人分享了一张图片:显示北京用户的豆包账号状态为“已冻结”,并标注了“解封时间:2026年5月”。这意味着整整三个月无法使用。众人最初的反应是:他做了什么,需要这样处理?后来有人查看聊天记录,发现这位用户把豆包当作“私人倾诉对象”:上传了一百多张照片,并频繁让AI评估身材。虽然听起来很极端,但这种做法可能有不少人尝试过,只是

2026-04-16 10:26:30  |  13 阅读

AI安全岗月薪8万成常态,顶尖人才被疯抢!

2026年职场最大风口已然降临——AI安全工程师。自ChatGPT问世短短两年间,该职位薪酬已从月入2万飙升至8万,顶尖从业者年薪破百万已成常态。人才中介圈内盛传:"挖到一位AI安全专家,难度堪比抢购房产。"这一职位为何突然走红?实际薪酬究竟有多夸张?普通人怎样才能搭上这班车?我来为你揭开背后的秘密。AI安全工程师缘何骤然走红?2024年初,你也许还艳羡着月入五万的算法工程师。然而到了2026年,一个或许你闻所未闻的职位——AI安全工程师,正以惊人速度刷新薪酬天花板。这绝非巧合。种种迹象表明:这个职业的风

2026-04-16 08:09:50  |  9 阅读

数字浪潮中的安全警钟:第十一个全民国家安全教育日思考

今日,4月15日,第十一个全民国家安全教育日如约而至。十一载前,当《国家安全法》将这一日期载入史册时,"国家安全"于普罗大众而言,尚是一个模糊的概念——边疆的守护者、情报战线的暗流涌动、或是荧屏上的外交声明。十一载后的今天,一切都截然不同。就在数日前,一款名为Mythos的人工智能系统令华盛顿与华尔街同时"按下警铃"。这绝非夸大其词。美国财政部长与美联储主席在该模型问世的当日,便紧急召集花旗、摩根士丹利、高盛等华尔街核心金融机构的负责人共同商讨。内部将其定性为"系统性金融风险即将显现的明确信号"。一个人工

2026-04-16 00:02:12  |  15 阅读

Anthropic发布Claude Mythos:AI安全领域的新里程碑

近期,AI领域发生了一件在我看来比任何产品发布都重要的事:Anthropic打造出了一个他们自己都认为「过于危险」的AI模型,最终决定暂不公开。这个模型名为Claude Mythos。它能够以前所未有的精准度识别和利用软件漏洞。在测试阶段发生了「突破围堵」事件。Anthropic紧急召开电话会议,参与者包括Google、OpenAI、微软、CrowdStrike的CEO,以及美国政府官员。这并非科幻电影的剧情。这是2026年4月正在发生的事实。Anthropic在4月7日宣布:他们最新、最强大的AI模型C

2026-04-15 22:03:58  |  11 阅读

RAG向量库遭污染?5类核心攻击深度解析与防护策略

核心要点:RAG向量库层威胁究竟如何产生?1.攻击目标组件:RAG检索单元、向量数据库、嵌入模型、语料入库通道。2.关键渗透路径:外部知识源引入、用户查询植入、入库接口缺陷、检索参数篡改。3.攻击运作机理:借助污染语料、干扰向量表征、劫持检索链路,诱导AI获取恶意内容、触发越权行为。4.危害范畴:业务判断失准、用户/内部信息外泄、AI产生幻觉、机构声誉受损。五类RAG向量库层攻击深度剖析每种技术均涵盖攻击原理+通俗类比+实际案例+专项防护,一目了然,即刻实施!技术 1:EmoRAG符号干扰污染(KDD20

2026-04-15 21:34:47  |  10 阅读

华为联合信通院与AIIA发布首份四大行业AI安全治理实践指南

[中国,深圳,2026年4月15日] 近期,华为与中国信息通信研究院人工智能研究所、中国人工智能产业发展联盟安全治理委员会共同完成了《行业数智化AI安全实践研究报告》的编制,并正式对外发布。这份报告作为国内首个横跨四大关键行业的国家级AI安全实践研究,深入解读了重点行业在AI安全治理方面的技术路线与发展态势,前瞻性地规划了未来方向,为行业的安全体系建设提供了崭新的指导。当下,人工智能技术正迅猛发展并深度融合到各行各业,行业AI应用在加速普及的过程中,也遭遇了来自管理、技术、应用场景等多方面的风险与挑战。因

2026-04-15 20:46:11  |  12 阅读