标签

【每日一词】零基础了解AI:模型微调是什么

所谓AI微调,就是以已经完成预训练的通用大模型为起点,借助特定领域的小批量数据对该模型开展二次训练,从而让它更好地匹配某一具体任务或行业需求。这就好比一个经历过"通识教育"的大学毕业生,走上工作岗位后还需经历"岗前实训",以便快速掌握特定业务的运作方式。微调的精髓体现在对参数的局部优化。预训练阶段让模型积累了大量通用语言知识,而进入微调阶段后,通过投喂医疗病历、法律条款、企业客服问答等专业化数据,模型便能逐步习得该领域的术语习惯与应答逻辑。比如,将通用模型微调为一个"文学赏析助理"后,当它解读张爱玲作品时

2026-09-03 22:03:22  |  3 阅读

智能穿戴零售额翻倍增长,商家关键瓶颈:讲透复杂产品

AI眼镜、智能手表与智能手环等可穿戴设备陆续渗透到日常消费中数据说明:国家统计局发布的是可穿戴智能设备的整体零售数据,并非单独统计AI眼镜。热点概览国家统计局数据显示,2026年1至7月,限额以上单位可穿戴智能设备零售额同比增幅超过100%;国家发展改革委亦宣布,2026年将智能眼镜列入消费品以旧换新补贴目录。智能眼镜、智能手表和智能手环正成为新的消费风口。对商家而言,品类走热固然是机遇,但流量涌入并不代表订单会自然增长。此类商品技术参数繁杂、型号区别细微、上手难度较高。消费者真正犹豫的,往往不是"感不感

2026-08-28 18:47:34  |  8 阅读

建筑造价AI洞察 | 万亿参数模型来了,成本测算还在用Excel?

点击蓝字 关注我们AI都迈入万亿参数时代了,造价行业却还在依赖Excel?今日推荐8月11日,英伟达被披露正在打造新一代开源大模型Nemotron 4,参数量级至少突破1万亿。同日发布的Nemotron 3.5 Lightning作为首款开源模型,能在单块GPU上运行——一边将模型规模推向万亿级别,一边降低普通设备的使用门槛。AI能力的天花板再次被刷新。然而反观建筑工程领域,不少企业的成本测算仍停留在Excel阶段。清单手工编制、价格逐条查询、报告反复撰写,一个项目下来造价人员加班到深夜,数据还分散在十几

2026-08-13 17:50:49  |  18 阅读

AI日报:英伟达押注万亿参数模型、OpenAI员工套现70亿、谷歌Gemini月活破十亿

今天是2026年8月12日,星期三。当下AI领域,头部公司动作频频,我筛选几件最具影响力的事件分享。据The Information披露,英伟达正打造新一代开源AI模型Nemotron 4,参数体量至少达到1万亿级别,志在冲击全球顶尖开源大模型行列。英伟达此前已推出Nemotron系列(3400亿参数的Nemotron-4 340B),核心用途涵盖训练数据合成、模型研发与企业级AI落地。此次跃升至万亿规模,显然是要与Qwen、DeepSeek、Meta等开源强者正面较量。我的判断:英伟达布局开源模型的底层

2026-08-13 12:07:02  |  16 阅读

服务器机柜滑轨如何选购

AI服务器安装滑轨怎样挑选,不少客户一开口就先询问滑轨报价。其实服务器滑轨涉及的参数相当多,安装方式涵盖手动、螺丝紧固以及免拆卸工具等不同类型。推荐先明确客户端所适配的机柜设备规格区间,再结合服务器机体的深度尺寸、左右宽度数值、滑轨在机箱侧壁的上中下固定点位、机箱侧板工字钉规格以及孔距等要素,来确定相应的款式选择、长度规格、安装模式,以及至关重要的承载负荷指标等参数。倘若有任何疑问均可随时咨询,我公司专注从事通用型、小批量定制化以及专项方案客制化服务器滑轨的研发设计与生产销售工作。

2026-08-13 09:09:10  |  50 阅读

英伟达研发万亿参数开源大模型Nemotron 4

8 月 11 日讯,据 The Information 报道,英伟达正致力于研发名为 Nemotron 4 的新一代 AI 系列模型,旨在与全球最顶尖的开源模型一较高下。英伟达是美国极少主动开源模型的大型科技公司。今年 AI 的研发及运行成本不断上涨,加之性能逼近 Anthropic 和 OpenAI 的国产低价模型增多,促使开源模型备受瞩目。频发的自主 AI 智能体黑客攻击事件,让开源模型热度攀升。这主要是因为开源模型通常不限制其网络安全用途。英伟达期望通过开放模型生态来拓展 AI 的应用边界,并进一步

2026-08-12 12:22:29  |  14 阅读

AI竞相迭代升级,人类沉溺短视频内耗

并非因它本领高强而生出的恐惧,而是内心深处止不住的忐忑:它或许已经不再需要我们了,这种隐忧才最令人煎熬。且听我细细道来。先来第一份重磅消息。昨日中关村的一场活动里,清华陈勇超团队抛出了一项名为Apex Research的成果——一套自主演进的AI系统。这套系统究竟有何能耐?它能独立开展科研,自主撰写论文,还向ACL 2026(自然语言处理顶级会议)递交了34篇投稿,其中11篇顺利过关,更有2篇在初审阶段超越了99%的人类初次投稿者。你觉得这就到头了?更惊人的是,它在数学领域推翻了一项流行十余年的经典论断,

2026-08-11 06:21:02  |  13 阅读

电力乙方如何抉择AI投标工具?三大核心问题助你辨别真伪

【投标实战指南|强烈建议保存】电力分包领域+配套采购方完整名录✅电力分包商十大核心业务方向输变电核心装备、电力一次设备及成套装置(含配电柜类别)、电线电缆及连接组件、电力二次及自动化系统、电能质量与无功补偿、电源及应急供电系统、新能源发电与储能、专用场景电气设备、电力工程及技术服务、电力辅材及施工耗材。每一份标书文件,都需要匹配不同采购方的评审规则、格式各异的招标文件以及严格的行业标准,容错空间极其有限。恰恰由于业务流程的复杂性,多数电力分包商负责人、标书主管,在接触AI投标工具时,普遍存在以下三层关键疑

2026-08-10 19:55:51  |  19 阅读

AI迈入“月抛”纪元:你的手机助手正在悄然升级

这个月,大模型领域竞争达到了新层次——短短一个月,9款旗舰产品密集亮相。阿里Qwen3.8、谷歌Gemini 3.6 Flash、混元Hy3、Kimi K3、Grok 4.5、Claude Opus 5……这一串名字念下来,舌头都要打结了。有人把这种现象称为“月抛”时代。我初次听到这个说法,忍不住笑了。仔细想想确实贴切:上个月还被捧上天的“全球最强”,这个月就被新的“全球最强”取代,如同手机壳一样,换得频繁,忘得也快。参数竞争也越来越夸张。Qwen3.8总参数高达2.4万亿,能自主编写16天的代码,还能打

2026-08-05 20:07:40  |  19 阅读

阿里Qwen3.8重磅发布:2.4万亿参数,编程与办公能力升级

新浪科技讯 8月3日上午消息,阿里巴巴发布新一代基座大模型Qwen3.8,总参数量2.4万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。 在今日放榜的权威三方榜单Arena中,阿里Qwen模型仅次于Anthropic的Claude系列,整体性能处于全球大模型第一梯队。目前,Qwen3.8的API已上线千问AI平台,并接入阿里今日同步推出的Agent产品“千问办公”。Qwen3.8-Max预计下周开源,同时还将开源 Qwen3.8-27B。(文猛) 责任编辑:江钰涵 新浪财经声明:此

2026-08-03 11:55:38  |  24 阅读

AI为何能输出复杂推理过程?原理大揭秘

AI 原理系列当我们使用AI时,若开启深度思考模式,模型会展示一连串的思考轨迹涵盖拆解难题、逻辑推导,甚至自我纠错比如像 “等等,感觉不对,我重新思考一下”这些繁复的逻辑推导究竟是如何实现的?首先,AI大模型的训练主要分为三个阶段预训练阶段监督微调阶段强化学习阶段别担心,这三个概念听起来很深奥,但我会尽量通俗地解释,让你了解核心逻辑让我们开始正题首先,AI大模型在完成预训练后—— 就从 初始模型 升级为 基座模型此时通过海量数据的洗礼,人类世界的常识与物理法则已被内化于模型内部具体是如何内化的?本质上就是

2026-07-21 02:46:04  |  40 阅读

一级市场AI投资转向应用落地新阶段

从"炼模型"到"拼落地" 一级市场AI投资逻辑重塑 ◎记者 邓贞 两年前的全球人工智能峰会(WAIC),是大型语言模型企业的"装备比拼"——参展方竞相展示参数规模、刷新融资记录。而在2026世界人工智能峰会上,一级市场投资者热议的焦点,转向了推理成本、商业化交付与上市时间节点。 上海证券报记者在大会现场调查发现,AI投资逻辑正在经历深刻转变:商业化应用与场景落地取代模型参数,成为项目估值的核心要素;相应地,长期资本与产业生态加速入局,为应用落地铺路搭桥。 场景落地成为"核心议题" "今年在WAIC上,投资

2026-07-20 14:51:27  |  25 阅读

天驰PLM AI+上线:语义+参数双引擎智能查料

制造业研发工程师,大多都被「找零件」拖累过研发进度:库里明明有现成物料,却因命名格式、空格、写法细微差异,无法检索匹配;需要匹配规格、性能适配的替代零件,只能人工逐条翻阅物料清单,耗时费力;存量物料长期闲置无法复用,团队只能反复新增物料建档,最终造成非标件堆积、物料库存冗余,持续抬高企业研发、采购与库存管理成本。针对制造业研发普遍存在的查料难、找料慢、复用低、建档冗余核心痛点,天驰PLM AI+版本正式发布!本次升级深耕研发实际场景,推出轻量化全新界面+双维度AI智能物料选型能力。在保留原有操作习惯、保障

2026-07-17 21:59:40  |  27 阅读

2.8万亿参数!中国AI企业推出全球最大开源模型

2026 年世界人工智能大会召开在即,月之暗面推出 Kimi K3,凭借 2.8 万亿参数量刷新全球开源模型纪录,成为国产 AI 进入国际领先行列的重要里程碑。参数好比大脑神经节点,超大规模使模型积累丰富知识、具备深度推理能力,而此次开发并未单纯追求体量,核心依赖自主研发架构解决算力消耗问题,突破了大模型越大越难实用的行业困境。模型采用改进的 MoE 混合专家框架,896 个专家模块按需仅启用 16 个,配合自研增量注意力架构,算力利用效率比前代提高 2.5 倍。100 万词元超长上下文加原生多模态功能,

2026-07-17 19:53:50  |  21 阅读

AI赋能气承式膜结构有限元分析实战教程

本节课程深入阐述了气承式膜结构的分析原理,并详细演示了在RFEM 6有限元软件中的建模与计算流程。核心内容包括:基础充气管模型分析:完整演示了织物与气体材料的选取、设定内部超压进行“形态分析”、配置防止奇异性问题的节点边界条件,以及对褶皱区域进行网格加密处理的工作流程。AI与API协同参数化建模:呈现了如何利用Dlubal API结合AI编程助手(如Claude),仅需自然语言描述即可自动生成Python脚本,高效构建复杂的充气拱形几何模型。强非线性问题诊断:深入解析了高柔性薄膜结构在数值计算中常见的强非

2026-07-17 17:56:02  |  29 阅读