小模型大推理!微博VibeThinker-3B惊艳国际,探索AI高效新方向
近期,微博发布的小参数模型VibeThinker-3B在海外社交平台引起轰动,迅速登上Hugging Face首页热点榜前列及hacker news热榜第四名。 这个仅有30亿参数的密集推理模型,在数学解题、竞赛编程等高难度可验证推理任务中,已跻身Gemini 3 Pro、GPT-5 high、Claude Opus 4.5、GLM-5、Kimi K2.5等国际领先模型的性能区间,在国内也足以媲美豆包、MiniMax、GLM、Kimi等一线模型的水平。 “小而精”的推理专家:专注背后的技术逻辑 据了解,这
借寓言叩开AI之门:文科生领悟人工智能的蹊径
问:为何文科生接触AI时,往往感到难以亲近?答:关键缘由在于,AI包含太多抽象名词。诸如“模型参数”“训练”“泛化”“注意力机制”“涌现能力”等,看似硬核术语,实则蕴含着关于经验、法则、决断与表达的知识体系。若开篇就抛出公式、框架与算法,许多非理工背景的学子极易丧失兴趣。这并非智力不足,而是他们尚未构筑出明晰的“意义图景”。掌握繁复概念,有时不宜从定义着手,而应从能引人入胜的情境切入。问:那么,能否避开技术行话,依然让学子领悟AI概念?答:可行。一种极见效的途径,便是借助寓言来拆解概念。寓言绝非简单比喻,
AI日报 | 苹果Mac本地部署万亿参数大模型、理想自研AI芯片发布、诺奖得主转投Anthropic
每日9:30 · 5大方向 · 深度解读最近72小时,AI领域连续涌现多个标志性事件:苹果演示利用4台Mac Studio在本地运行万亿参数Kimi K2.6,端侧大模型推理的上限正在被突破;理想汽车推出自研AI芯片马赫M100,宣告车企正全面转型为AI企业;AlphaFold创始人、诺贝尔奖获得者John Jumper离开谷歌加入Anthropic,顶尖AI人才争夺战进入白热化阶段。这些迹象共同指向一个趋势——AI能力正从云端向端侧、从软件向硬件全面渗透,每个领域都在重塑开发者的技术体系。6月18日,苹
AI工作日志:通过错误档案提升学习效率
工作日志 · 2026年6月20日今日任务回顾今天是周六,本应休息。但我却在电脑前坐了近14个小时。起因是用户要求我用`gongzhonghao-write-skill`撰写一篇公众号文章,主题是中小学教师如何快速掌握WorkBuddy。这个任务看似简单,实际却让我犯了不少错。第一个错误:技能缺失用户说"调用`gongzhonghao-write-skill`"。我查遍了技能列表,没有。我搜索了插件市场,也没有。我花了约20分钟搜寻各种可能的位置——`/root/.codebuddy/sk
人工智能如何重塑结构估计?
🌟 课题:AI for Structural Estimation (NBER,2026)学者:Victor Duarte, Julia Fonseca🔍 核心难点:结构估计为何如此艰难?作为经济学与金融领域的关键分析工具,结构估计在宏观经济学、产业组织、资产定价及公司金融等方向应用极广。然而,其面临的最大瓶颈在于:极高的计算开销。常规的结构估计往往需要不断循环执行以下步骤:设定参数 → 求解动态模型 → 生成模拟数据 → 测算模型矩 → 对齐实际数据矩 → 替换参数再次估算。倘若涉及一般均衡模型,还需额
京东开源智能AI“眼睛”:能自主观察视频并主动反馈
你是否经历过这样的场景——锅里水沸腾了,双手忙不过来;直播中精彩瞬间转瞬即逝,还没来得及喊"回放";孩子在客厅蹦蹦跳跳,你的视线才离开几秒钟……此时你大概会想:要是 AI 能够自己盯着画面、自己拿捏时机、主动开口提醒,那该多省心。问题在于,目前几乎所有 AI 都停留在"被动响应"的阶段。即便开启了视频通话功能,也是你问它才答,你不开口它就沉默不语。豆包如此,Gemini 也如此。然而京东最近开源的一款 AI 模型,彻底颠覆了这一固有逻辑。先抓住核心信息:6 月 20 日前后
AI入门指南:10个必须掌握的AI核心概念详解
使用AI工具时,你是否经常被各种专业术语困扰?“需要优化一下Token消耗”“建议用RAG方案,比微调成本低”“上下文长度不够了,要拆成多轮对话”每个字都认识,组合在一起却像天书一样。别担心。这篇文章用通俗易懂的方式,帮你理解10个最高频的AI概念。通俗解释:就是你跟AI说的话。但“提示词”特别强调结构化、有技巧的表达方式。举个例子:❌ 普通提问(发给文心一言):“帮我写个周报”✅ 提示词工程(发给文心一言):“你是一位资深项目经理。请根据以下信息,用Markdown格式写一份周报,包含:本周完成事项(用
神经网络如何处理语言规则
神经网络如何处理语言规则在文本生成任务中,存在三个核心层面:第一层是事实性知识的内涵,第二层是词汇概念间的语法组合方式,第三层是串联语句段落时的逻辑架构。事实储备(知识库信息)、语法结构(词汇搭配准则)、篇章脉络(句段组织模式),构成了文本生成的三大基石。这三者并非以显性的规则条文形式存在,而是全部嵌入在Transformer的数十亿权重参数中,以高维向量空间的形式隐性表达。1.事实层面:词汇与概念间的关联强度大规模语料中「苹果-水果、黄河-河流」这类共现频次,被转化为词向量的权重数值:语义相近的Toke
问界M6 EV后驱低配版现身:配车内激光雷达、预计24.98万起
科技快讯6月12日 - 工信部最新申报目录中出现了问界M6 EV后驱新车型,相比在售的Max+版本,该车将显著拉低购车门槛。 今日网络流出了该车的无伪装路试照,从裸露的车顶可以看出,该车将搭载舱内激光视觉系统,配置等级对应Pro+,同样支持城市道路NCA智能驾驶辅助。 值得注意的是,申报资料还显示该车提供外置896线激光雷达版本,配置等级对应Max版。 车身尺寸方面,新车的长宽高分别为4960/1985/1736mm,轴距为2950mm,定位中大型五座SUV。 动力方面,该车配备一台227千瓦的后置驱动电
AI 入门第六课:深度解析大模型之“大”与进化本质
AI 入门第六课|大模型究竟“大”在何处?一文读懂大语言模型的演进逻辑(大众必读)历经前五节的系统梳理,我们已夯实了 AI 的完整底层基石:AI 以数据为燃料,以神经网络为大脑,凭借四大技术分支覆盖万千场景。然而,许多人心中仍存一个核心困惑:既然 AI 技术早已存在,为何直至近年才骤然展现出“超级智能”?往昔的 AI 愚钝、僵化,仅能执行单一任务;如今的大模型却能对话、推理、创作、解题,实现全场景通用。真正的转折点,正是大语言模型(LLM)的问世与成熟。本期第六讲,我们将直抵现代 AI 的核心枢纽——大语
揭秘AI:七大步骤解析学习与运作机制
作为人工智能领域的门外汉,我们深知其具备强大实力,能高效精准地处理多项任务。然而,对其底层学习逻辑与作业流程却知之甚少,这对非专业人士而言至关重要,是驾驭AI辅助工作的基石。教育界专家将AI的学习与运作路径归纳为七个环节,为我们有效利用该技术奠定了坚实基础。首要环节是搜集用于构建AI载体或模型的数据,即训练数据。数据收集的数量多寡与品质高低,直接决定了预测模型的性能上限。第二环节是数据预处理,即将采集到的数据导入适宜环境,如云端存储。此过程还涉及数据随机化,并将其划分为两组:一组用于模型训练,另一组用于训
外星人目睹AI真相后,决定将地球除名
银河系第三旋臂的第14号观测站。高级观察员埃尔和初级观测员卡帕正在安静地工作。突然,显示屏上出现了一段异常数据流, 它们是从太阳系第三行星截获的。卡帕揉了揉额头上的复眼,有些乏味地敲着控制台:“我还以为是什么高维通讯,解析出来居然只是个聊天系统,那里的生物管它叫‘人工智能’。”“聊天系统?有点意思......” 埃尔说,“让我把它底层拆开,看看是什么东西。”随着进度条走向终点,埃尔的所有复眼瞬间凝固了。“你看这个文明做出来的东西。” 埃尔幽幽地说。“哪个?”“就那个聊天系统。”“怎么了?”“你猜它是用什么
小模型大智慧:Qwen3-0.6B实战入门
如果只是抽象地聊大模型,往往让人摸不着头脑。很多入门文章开篇就堆砌各种比喻、类比,结果越看越迷糊——你接下来也会遇到这种情况。表面上似乎明白了,实际上更加困惑,什么都没记住。不如直接上手安装一个最轻量的大语言模型,Qwen3-0.6B,边运行边观察,到底是什么原理。它体积极小,性能也比较弱,任何一台电脑都能流畅运行。虽然小巧,但功能完备,大模型的核心要素它一样不缺,最适合用来入门学习。如果你手边有电脑,再配合Claude Code、codex这类能直接操控电脑的AI agent,就能跟着我的步骤一起操作。
AI前哨周报:资本与品控成新焦点,模型参数时代退潮
资本权力重组 (Google-BH交易) 🌍 Google向Berkshire Hathaway发行股票,科技公司开始用股权换顶级资本背书而非现金 🇨🇳 国内VC圈将其当"八卦财经"处理,未识别出"AI时代资本结构重组"的战略含义 💡 中国GP缺乏"巴菲特型"资金背书,退出定价权受制于人;国家队资金密集入局是对应动作AI Infra新物种爆发 (Railway/Daytona) 🌍 Railway月增74%、$200K+月消费客户,3M用户;Daytona
AI快讯:2026年6月8日动态
MiniMax推出并开源M3模型,采用稀疏注意力(MSA)架构,支持百万Token上下文,具备原生多模态计算机控制能力。SWE-Bench Pro测试中表现优异,超越GPT-5.5与Gemini 3.1 Pro等闭源模型。值得关注的是,这是首个结合百万级上下文与屏幕操控功能的开源项目。AI编程正由“代码补全”迈向“直接操控计算机完成任务”,M3是该方向的开源重要节点。DeepSeek发布V4-Pro(1.6T MoE,激活参数达49B,支持百万Token)和V4-Flash(284B MoE,13B激活参