标签

利用零值的AI芯片突破

对人工智能模型而言,算力规模往往决定上限。尽管一些AI从业者提醒,像大规模语言模型(LLM)这类技术的效果提升可能正在出现边际递减,企业依旧持续发布规模更大的AI产品。Meta 最近推出的Llama模型就配备了高达2万亿个参数。模型越大,能力通常也越强。但与此同时,它的用电量和运行时间也会随之上升,进一步推高碳排放。为降低这些代价,人们转而采用更小但能力更有限的模型,并尽量用更低精度的参数配置。不过还有另一条思路:既保留大模型的高性能,又能显著减少运行时间与能耗。关键在于“善待”大模型内部的零值(This

2026-05-03 08:41:29  |  19 阅读

JFM综述:AI重塑CFD的四大支柱与可信度基石

近年来,AI在计算流体力学(CFD)行业的迅猛发展,令众多工程师倍感压力:这到底是技术层面的颠覆性变革,还是仅仅是一场学术上的泡沫炒作?近期,流体力学顶级期刊《Journal of Fluid Mechanics》刊载了一篇深度综述《Routes towards an effective AI in CFD: an epistemological and technical perspective》。作者 Michaël Bauerheim 没有局限于罗列算法,而是站在“认识论”的高度提出了核心问题:数学

2026-04-25 09:46:08  |  11 阅读
从“对话便宜”到“智能体便宜”:DeepSeek-V4引领大模型价格战进入智能体时代

从“对话便宜”到“智能体便宜”:DeepSeek-V4引领大模型价格战进入智能体时代

每经记者兰素英 每经编辑王嘉琦 报道历经15个月的等待,今日(4月24日),DeepSeek-V4(预览版)终于面世,发布时间紧随OpenAI发布GPT-5.5之后仅数小时。在DeepSeek-V4约1000字的产品介绍中,“智能体”一词被反复提及,共出现11次。DeepSeek-V4通过专家模式(Pro)与快速模式(Flash)的双版本配置,将大模型价格战从“对话便宜”推向“智能体便宜”的新阶段。凭借全新的稀疏注意力机制与同策略蒸馏技术,DeepSeek-V4将推理成本压缩至新低,其中V4-Flash版

2026-04-24 17:52:17  |  32 阅读

研究生魏荣轩在Neurocomputing发表论文

2026年3月29日,人工智能与计算机学院(智慧教育学院)教育人工智能团队的研究生魏荣轩以通讯作者身份,在《Neurocomputing》(SCI期刊,中科院二区,JCR Q1)上发表了题为《MAGNet: Bridging global graph context with customized tail-biased sampling for recommendation》的研究论文。期刊概述《Neurocomputing》由Elsevier出版,是中国计算机学会推荐的学术期刊。该期刊主要刊登神经计算

2026-04-04 14:19:38  |  22 阅读