标签

大模型背后的数学支柱

人工智能的基础有哪些呢?在常见的讨论中,常给出的答案往往是"算力""数据"或"Transformer 架构"。这些回答并没有错,却停留在工程层面。若沿着技术栈继续下探,会发现真正支撑 GPT、Claude、Gemini 等新一代大语言模型(Large Language Model, LLM)的,是三门基础的数学学科——线性代数、微积分、概率与统计。事实上,学界目前尚缺乏一套能够完整解释 Transformer 全部行为的统一数学理论(Tai et al., 2025);但在"输入表示—信息加工—参数训练"

2026-07-10 08:38:21  |  17 阅读

人工智能发展史:解构智能起源的五大关键

人工智能发展史:解构智能起源的五大关键智能究竟源自何处?随着大模型能力的持续跃升,这个核心谜题反而愈发引人深思。回望人工智能八十余载的发展轨迹,其本质是一部人类不断解构、探寻智能本源的思想演进史,一代代研究者的认知升级,共同拼凑出了智能起源的完整脉络。人工智能的探索肇始于20世纪40年代,当时科学家首次利用数学公式模拟人脑神经元运作,为机器复刻智能奠定了理论基础。随后,图灵提出了“机器能思考吗”这一经典命题,正式拉开了人工智能研究的序幕。这场技术探索的核心,始终是人类对智能本质的深度哲学思辨。早期学界确立

2026-07-01 12:24:26  |  18 阅读

AI 本质即数学:如何高效掌握核心知识体系

这确实是个极佳的切入点。基于你此前表达的“渴望深度理解”的诉求,我为你梳理了一套“最小必要数学知识框架”。该体系不追求数学专业的全面性,而是聚焦于“让你透彻明白 AI 模型运作机制”的深度。一、数学知识图谱(依优先级排列)1. 线性代数(AI 的骨架)这是你提及的“向量”概念的升级版,亦是 AI 领域的通用语言。- 核心概念:向量、矩阵、张量(高维矩阵)、矩阵乘法(神经网络本质上是一系列矩阵运算)。- 进阶理解:特征值与特征向量(用于理解主成分分析 PCA)、奇异值分解(SVD,用于理解数据压缩)。- 学

2026-05-30 06:12:59  |  29 阅读