标签

AI落地新趋势:小模型、具身智能与低代码Agent崛起

OpenAI刚发布的GPT-4o将音视频交互延迟压缩至200ms内,当天硅谷就有17家创业公司暂停原有多模态研发。AI迭代速度已快到‘跟不上即出局’。本文拆解四大前沿方向,助你把握下半年AI核心机遇。小参数模型性能反超千亿大模型今年Q1最意外突破,来自Mistral发布的7B参数模型Mistral Small,在MMLU测试中得分83.2%,超越GPT-3.5的83.1%,参数量仅为后者的1/20。国内厂商同步跟进,字节豆包4-7B、百度文心一言轻量版均实现10B参数内性能媲美去年百亿级模型。核心在于新型

2026-07-09 21:38:04  |  13 阅读

面壁智能:中国AI创业公司深度剖析

本次我们聚焦的公司是“面壁智能”。与众多AI初创企业相似,面壁智能尚未上市,处于融资进程中,产品持续迭代,商业化路径仍在摸索。严格来讲,普通大众既无法购买其股票,也难以直接涉足其业务。那么,为何我还要撰写关于它的文章?理由很简单:那些看似与普通人无关的企业,恰恰最值得普通人关注。它不仅仅是一家公司,更是整个行业趋势的缩影。如果仅关注热搜话题,你会认为所有AI公司都大同小异:都在研发大模型、聊天机器人和应用。但当你深入剖析,会发现差异巨大:有的公司争夺算力资源,有的专注于端侧部署,有的则聚焦于行业落地能力。

2026-07-05 21:13:12  |  25 阅读

AI资讯:Coinbase采用中国模型削减成本;360推出AI安全攻防利器;新浪发布VibeThinker-3B开源模型

特斯拉自动驾驶事故调查升级Tesla的FSD系统安全争议再度升温。美国国家公路交通安全管理局和国家运输安全委员会已介入一起Tesla车辆涉及的致命事故调查,同时Tesla就另一宗与FSD相关的致命事件达成和解。这一事件将FSD在低能见度、驾驶员接管和责任界定方面的隐患重新推向监管前沿。Coinbase转向中国模型实现降本Coinbase首席执行官Brian Armstrong透露,公司已加大使用GLM 5.2、Kimi 2.7等中国模型,并通过自动路由根据任务、价格和缓存效果选择模型。据The Decod

2026-06-29 09:50:21  |  36 阅读

银行AI如何衡量回报?交行、邮储、厦门银行实践揭秘

"银行业迫切需要一套权威、统一的AI价值评估体系。"6月17日,在新金融联盟主办的"AI提升金融业务价值的问题与解决路径"内部研讨会上,邮储银行金融科技部副总经理呙亚南道出了与会者的普遍共识。这是新金融联盟第105期内部研讨会,由秘书长吴雨珊主持,中国金融四十人论坛提供学术支持。工商银行原首席技术官吕仲涛作主题分享,交通银行金融科技部副总经理朱麟、邮储银行金融科技部副总经理呙亚南、恒丰银行首席信息官徐彤、厦门银行副行长郑承满、蚂蚁数科金融事业部总经理曹刚发表见解,近20家银行代表参会。当前,金融行业已告别

2026-06-25 19:02:26  |  19 阅读
小模型大推理!微博VibeThinker-3B惊艳国际,探索AI高效新方向

小模型大推理!微博VibeThinker-3B惊艳国际,探索AI高效新方向

近期,微博发布的小参数模型VibeThinker-3B在海外社交平台引起轰动,迅速登上Hugging Face首页热点榜前列及hacker news热榜第四名。 这个仅有30亿参数的密集推理模型,在数学解题、竞赛编程等高难度可验证推理任务中,已跻身Gemini 3 Pro、GPT-5 high、Claude Opus 4.5、GLM-5、Kimi K2.5等国际领先模型的性能区间,在国内也足以媲美豆包、MiniMax、GLM、Kimi等一线模型的水平。 “小而精”的推理专家:专注背后的技术逻辑 据了解,这

2026-06-25 16:31:32  |  19 阅读

AI日报|今日AI圈三大要闻速递(2026-06-15)

日期:2026-06-15 08:08 · 共收录 10 条资讯 · 关键词:月之暗面开源新一代编程专用模型、AI、科技月之暗面正式开源 Kimi K2.7 Code 编程模型,相比 K2.6 版本在长上下文编程、指令遵循及Agent自主执行能力方面实现显著升级,代码基准测试提升幅度达11%至31.5%,token消耗降低30%,API定价与K2.6保持一致。该模型需开启思考模式才能发挥最佳性能表现。• 详情:https://mp.weixin.qq.com/s/NBw1VAA9MjpKv-Rirq9qD

2026-06-15 08:19:36  |  39 阅读

AI 入门第六课:深度解析大模型之“大”与进化本质

AI 入门第六课|大模型究竟“大”在何处?一文读懂大语言模型的演进逻辑(大众必读)历经前五节的系统梳理,我们已夯实了 AI 的完整底层基石:AI 以数据为燃料,以神经网络为大脑,凭借四大技术分支覆盖万千场景。然而,许多人心中仍存一个核心困惑:既然 AI 技术早已存在,为何直至近年才骤然展现出“超级智能”?往昔的 AI 愚钝、僵化,仅能执行单一任务;如今的大模型却能对话、推理、创作、解题,实现全场景通用。真正的转折点,正是大语言模型(LLM)的问世与成熟。本期第六讲,我们将直抵现代 AI 的核心枢纽——大语

2026-06-11 11:57:24  |  31 阅读

AI 变局·2026-06-07 成本狂降九成,行业迎来至暗时刻?

今日目睹一组数据,令我瞬间惊愕。有人利用完全相同的代码、提示词,以及 17 个预设漏洞,分别测试 MiniMax M3 与 Claude Opus 4.8 的代码审计能力。结局如何?M3 检出 13 个,Opus 同样检出 13 个。双方平手。然而成本却天差地别。M3 仅耗费 $0.07。Opus 则高达 $1.30。差距接近 20 倍之多。请细品这组数字。$0.07 约合人民币五毛。五毛钱便完成了一次代码库审计,并揪出 13 个漏洞。反观另一方,那个被誉为“最强大脑”的模型,干着同样的活,却向你索要 9

2026-06-07 18:18:32  |  37 阅读
姚顺雨:中国AI成本优化领跑世界

姚顺雨:中国AI成本优化领跑世界

新浪科技讯 6月5日早间报道,在今日举行的2026年腾讯云AI产业应用峰会上,腾讯集团高级执行副总裁、云与智慧产业事业群CEO汤道生与腾讯首席AI科学家姚顺雨进行了深入交流,探讨的话题聚焦于腾讯AI下半场的发展。 针对当前行业高度关注的AI降本增效难题,姚顺雨指出,“首要任务依然是performance,这直接决定了性价比的高低。我认为,今年如何精准完成大量相对基础的任务,比单纯追求模型架构更为关键,这关乎性价比的核心。” 他补充道,“在我看来,性价比的核心首推性能,若性能欠佳,性价比便无从谈起。其次则是

2026-06-05 17:53:52  |  28 阅读
周光:小模型触及天花板,自动驾驶亟需范式跃迁

周光:小模型触及天花板,自动驾驶亟需范式跃迁

专题:2026未来汽车先行者大会 2026第四届未来汽车先行者大会于5月29日至5月30日在深圳举行,元戎启行CEO周光出席并发表了演讲。 他提到,鉴于小模型技术路线已触碰能力极限,自动驾驶行业正处于从“执行系统”向“认知系统”转型的关键转折点,利用大模型和物理AI为核心的技术模式将是打破当前僵局的关键。 周光指出,过去五年是自动驾驶依赖小模型发展的时期。但是,小模型系统普遍存在“跷跷板效应”,也就是在解决一个场景问题时,往往会在其他场景引发新问题,造成系统稳定性欠缺,难以赢得用户的长期信任。 他觉得,现

2026-05-29 18:03:19  |  12 阅读

普惠 AI:小模型开启新机遇

人工智能的角逐是否必然指向巨型模型与庞大算力中心?🌐 ⚡变革正在无声发生:新一代轻量化 #人工智能 模型应运而生,即便在基建薄弱或网络受限区域也能顺畅运行。弥合数字鸿沟,不单靠技术本身,更关乎技术的设计初衷与管理模式。🤝 🏛️联合国教科文组织倡导以人为本且可持续的 AI 战略,确保创新能拓展机遇而非加深不平等。

2026-05-27 09:55:42  |  13 阅读

澳洲大叔三行代码破解AI瓶颈,三大巨头火速跟进

在澳洲乡间牧羊的资深开发者,仅需编写3行Bash脚本,短短11天内,便引得OpenAI、Anthropic、Nous Research这三家全球顶尖AI机构争相效仿,将其核心逻辑融入自家官方产品。4月30日:OpenAI Codex CLI 发布/goal功能Greg Brockman 在推特留言:“Codex现已集成Ralph loop++”第7天(5月6日):Nous Research Hermes Agent 紧随其后,内置相同循环机制第11天(5月10日):Anthropic Claude Cod

2026-05-17 10:31:19  |  11 阅读

AI前沿|文心5.1低成本登顶搜索榜,DeepSeek融资破纪录,OpenAI首届AI原生代毕业

1. 百度发布文心大模型5.1版本,以行业6%的预训练成本实现搜索榜登顶5月9日,百度推出新一代基础大模型文心5.1,运用"多维弹性预训练"技术,仅用同类模型约6%的预训练成本便达到基础性能领先水平。在LMArena大模型竞技场最新榜单中,文心5.1凭借1223分斩获国内搜索榜冠军、全球第四,成为唯一入围的国产模型。其智能体能力已反超DeepSeek-V4-Pro,创意文本生成水平媲美Gemini 3.1 Pro,推理性能逼近业界顶尖闭源模型。该模型将总参数缩减至约三分之一、激活参数压缩至约二分之一,体现

2026-05-09 13:46:23  |  30 阅读

DeepMind CEO深度解读:AGI五年内或成真,小模型潜力巨大

2026年4月,诺贝尔化学奖得主、DeepMind CEO德米斯·哈萨比斯在一次播客访谈中分享了其对人工智能未来的深刻见解。本次访谈内容丰富,以下为关键观点的梳理,其中最后一部分与我们每个人息息相关。一、AGI五年内实现的可能性极高哈萨比斯表示:“未来五年内实现AGI的概率非常高。所以那并不遥远。”这一预测并非空穴来风。DeepMind联合创始人谢恩·莱格在2010年公司成立之初就曾预测AGI大约需要20年,而哈萨比斯认为这一判断“其实没有太大变化”。近期,业界多位领军人物也对AGI的到来给出了时间表:A

2026-05-05 02:04:44  |  16 阅读

告别“虚胖”拥抱“精瘦”:美国反蒸馏联盟的焦虑

告别“虚胖”拥抱“精瘦”:美国反蒸馏联盟的焦虑AI大模型虽发展迅猛,却遭遇了瓶颈。即便投入巨资堆砌万亿参数,也未能带来质的飞跃。你是否也有同感:向它提问一个简单问题,它却绕了半天弯路,罗列一堆背景,最后给出的答案还平平无奇。正因如此,“精馏小模型”(亦称精瘦模型)和“知识密度”的概念应运而生。知识密度 = 有用信息 / 参数规模与算力消耗依据这一公式,如今许多大模型实则是个“虚胖子”,吸纳了海量无关信息。这好比你去买颗菜,它却先给你科普了一整段农业发展史。大模型固然强大,但在诸多场景中,我们未必需要如此“

2026-04-18 07:36:24  |  23 阅读