标签

企业AI部署新思路:从云端到本地的四阶段迁移指南

OpenAI调价后部分企业费用骤增三成五,新锐播客主持人坦言:在本地运行AI模型并非单纯为了省钱,而是为自己构建一座能抵御断网、断供、断算力的“AI避难所”。此刻,一场“从云端到本地”的迁移方案正引发企业管理层热议。面对OpenAI涨价、算力紧张、地缘政治风险三大挑战,业界推出从OpenRouter到纯本地部署的四级AI自建方案。•OpenAI调价后,未调整提示词的企业费用突然增加三成五。•算力供给至少需等到2030年才能缓解,台积电与英伟达均持此观点。•本地部署AI需五层结构:硬件、模型、服务、代理层及

2026-06-22 08:37:24  |  22 阅读

英伟达突破:AI编程代理赋能机器人完成GPU精准装配与扎带处理

6月17日,英伟达GEAR实验室公布重大突破:AI编程代理已成功训练机器人掌握高精度装配技能,包括将GPU精确嵌入主板PCIe接口、剪切并绑扎束线等精细工序。这一进展意味着人工智能从代码生成向真实物理世界自主学习的重大转变。据实验室透露,ENPIRE架构使AI编程代理(基于OpenAI GPT-5.5、Anthropic Claude Opus 4.7、Moonshot Kimi Code等前沿模型)能够独立设计、验证并改进机器人训练方案,几乎无需人工持续介入。整个系统形成完整闭环:代理提出算法策略(涵盖

2026-06-21 22:32:17  |  20 阅读
沐曦联手优必选,在英伟达腹地落子!

沐曦联手优必选,在英伟达腹地落子!

炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会! 中经记者 李玉洋 上海报道 沪上明星GPU企业沐曦股份(769.890, 37.39, 5.10%)(688802.SH)近日有两大动作。 6月12日,该公司发布公告称,拟发行境外上市外资股(H股)股票,并申请在香港联合交易所有限公司主板挂牌上市;6月11日,其已与“人形机器人(17.850, 0.68, 3.96%)第一股”优必选(09880.HK)正式签订战略合作协议,合资成立曦选创智科技(无锡)有限公司(以下简称“曦选创智”)

2026-06-21 11:59:44  |  16 阅读
欧陆通携手谷歌GPU电源项目,股价刷新历史高位

欧陆通携手谷歌GPU电源项目,股价刷新历史高位

炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会! 近一周,美埃科技(78.730, -5.01, -5.98%)、立昂微(70.200, -0.75, -1.06%)、欧陆通(380.060, 6.05, 1.62%)等个股获机构密集调研。 近一周机构调研个股有170多只 近一周(6月12日至18日)机构调研个股有170多只,美埃科技获调研机构数最多。 美埃科技有182家机构调研,包括57家基金公司、20家证券公司、12家私募、7家保险公司等。美埃科技在机构调研中表示,公司的产品主

2026-06-21 08:58:20  |  20 阅读

企业AI助手普及引爆GPU推理算力市场

随着AI技术加速渗透至企业生产环节,越来越多的公司开始借助AI工具进行办公辅助,这一发展动向对底层的算力基础设施提出了崭新的挑战。据虎嗅调研数据,大量中小商户及实体企业已把AI当作日常工作的“伙伴”,广泛用于客户服务、文案创作、数据处理等领域。这种常态化的AI使用实际上构成了对推理算力的持续消耗。此前业界关注点多在于大模型训练阶段的算力缺口,如今企业端AI的普及正引发推理算力的爆发式增长:大部分企业现有的IT架构难以应对高峰期的并发推理压力,响应迟缓等问题根源在于底层算力供应匮乏。此外,不同规模企业的需求

2026-06-20 10:27:38  |  9 阅读

AI能源危机的解药是专用芯片

西德克萨斯的一片田野里坐落着29台喷气发动机。OpenAI的基础设施合作伙伴Crusoe于2024年底至2025年中分两批订购了这些产品。每个机组约产生35兆瓦电力;它们合计产生1吉瓦,输出功率大约相当于核反应堆。此类投资反映了一种时尚担忧:人工智能对电力的需求会扼杀当前的人工智能热潮——美国会在对人工智能计算需求耗尽之前耗尽电力。虽然电力确实是近期的运营瓶颈,但芯片中的电力问题将得到解决。自2022年以来,燃气发电厂的建设成本翻了一番多,达到每千瓦2200至2500美元。像Meta和Microsoft这

2026-06-20 09:55:34  |  29 阅读

解密AI计算力的真面目

(图片由AI生成)“人工智能算力”这词听起来就像黑匣子里的玄虚概念。让我用最贴近日常的方式,把它拆解成你“能看见、能触摸”的东西。一、暂且抛开“算力”,抓住两个字:“智力”你可以把AI模型当作一个超级勤奋的学生:1·学习阶段:这个学生要把全球的知识(所有书籍、文章、图像、视频)统统吸收一遍。它需要闪电般的运算速度来完成数亿道习题、记下数十亿个知识点。这里的“速度”,就是学习算力。2·应用阶段:你向它提问(比如“帮我生成一段文案”或“制作一张熊猫弹吉他的图像”),它必须在几秒内搜索自己的“记忆库”,整理出答

2026-06-20 09:54:18  |  15 阅读

轻松读懂AI算力发展三阶段

什么是AI算力发展三阶段?就是从数据传输快,到数据存储快,再到数据处理快。第一阶段,数据传输快。2023年为了解决数据传输快的问题,光模块变得热门,为什么热门?因为AI算力在大规模建设服务器集群,服务器之间需要频繁交换数据,传统方式使用普通铜电线搭配400G以下的低速光模块传输。传输速度慢、发热严重、带宽上限低,远距离传输时信号衰减明显,完全无法满足AI超大流量数据交换的需求。所以第一阶段就是要打通服务器之间的通道,解决数据传输拥堵的问题。于是将电传输转为光纤传输并搭配800G、1.6G高速光模块,光模块

2026-06-20 00:26:21  |  18 阅读

AI融资新纪录与人形机器人身份证时代来临

6月16日,DeepSeek完成成立以来首轮融资,募资超500亿元人民币(约74亿美元),刷新中国AI行业单轮融资最高纪录。融资后公司估值突破3380亿元(约500亿美元),跻身国内估值最高的AI企业之列。融资结构备受瞩目:创始人梁文锋个人出资约200亿元,为最大股东;腾讯出资约100亿元;宁德时代体系投入约50亿元;京东、网易、阿里巴巴等亦参与投资。更关键的是,资金需注入梁文锋主导的有限合伙企业,而非直接注资DeepSeek,以保障创始团队绝对控制权。此举开创中国AI独角兽融资新模式——资本仅作财务投入

2026-06-19 14:59:08  |  16 阅读

AI学习机广泛普及推动GPU推理算力需求上扬

AI大模型逐步下沉至消费终端,各类AI硬件产品纷纷落地,持续推动全球算力基础设施需求扩容。近期行业聚焦多家头部科技厂商布局AI学习机领域,从算力基础设施层面来看,AI学习机的爆发式增长背后,潜藏着显著的算力缺口。AI学习机的个性化答疑、自适应AI辅导等核心功能,依托云端大模型的实时推理服务,单次用户交互便需消耗一定推理算力,当用户规模达到百万量级后,对弹性GPU算力的需求将呈指数级攀升。同时,学习机专属大模型的迭代训练,同样需要稳定的大吞吐量训练算力支撑,不少新入局品牌此前未搭建自有算力,当前算力缺口已直

2026-06-19 09:53:17  |  9 阅读

英伟达AI机器人提速GPU装配

当前全球AI大模型迭代加速,GPU需求持续暴涨,算力服务器交付效率成为行业核心瓶颈。据外媒ArsTechnica报道,英伟达训练的AI编码智能体已教会工业机器人完成全自动GPU安装作业。传统高密度GPU服务器装配依赖人工完成多GPU对位、接线、固定等多道工序,流程繁琐且容错率低,单台8卡GPU服务器装配耗时可达数小时,一直是GPU服务器量产环节的主要卡点。AI赋能的机器人装配方案,可将单台服务器GPU安装时间压缩至数十分钟,错误率降至千分之一以下,大幅拉升了GPU服务器的整体装配产能,刚好匹配英伟达新一代

2026-06-18 20:23:55  |  28 阅读

XR AI全新发布:支持DGX Spark,实现实时多模态交互

运行示例项目本地显存占用全套四大模型服务(model-servers)约70GB独立视觉语言示例(simple-vlm-example)约23GBXR渲染演示工程(依赖全套模型服务)70GB模型显存+2GB中枢及语音合成显存仅运行项目中枢服务无需本地显存软件依赖项指定版本补充说明操作系统Ubuntu 22.04 / 24.04仅推荐两款LTS长期支持版Ubuntu系统Python3.11 / 3.123.10及3.13版本均不兼容,无法正常运行uv依赖管理工具最新稳定版项目所有示例工程统一使用uv管理依赖

2026-06-18 09:10:21  |  17 阅读

AI算力超级周期来临:10家国产算力核心企业深度梳理

2026年全球AI产业迈入商业化落地关键阶段,大模型多模态持续进化、AI智能体实现规模化部署、全国智算中心集中启动建设,推动算力需求从传统训练模式向高频推理算力爆发阶段全面转变。境外高端算力芯片供应持续受限,国内算力建设全面提速,国产GPU、HBM高带宽存储、先进封装、高速互联硬件迎来全面替代窗口期。行业正式告别概念炒作阶段,进入业绩兑现与国产替代双主升周期。各地东数西算枢纽节点加速落地,万卡级AI算力集群批量建成,政企、互联网、工业端算力采购需求持续放量,叠加境外新架构硬件迭代倒逼国内供应链升级,AI算

2026-06-18 02:54:10  |  17 阅读

AI算力背后的隐形短板:光纤告急

过去半年里,全球AI领域的焦点,已悄然从芯片转移。当大众紧盯英伟达GPU产能时,一个意想不到的制约正在浮现——光纤。即便你家宽带的玻璃丝,这次也不再用于客厅,而是涌入AI数据中心——速度与成本都惊人。一、AI数据中心:光纤的“大胃王”AI训练集群拥有数万GPU,需协同工作并传输海量数据。超出短距离后,铜线因过热或信号衰减无法胜任。唯有光能穿透玻璃完成传输。结果:一个GPU机架所需光纤,是传统CPU机架的36倍。36倍,非36%。2024年,数据中心光纤需求占比不足5%,预计2027年将飙升至30%。CRU

2026-06-18 02:02:21  |  13 阅读

燧原科技IPO过会彰显国控集团AI投资战略眼光

6月15日,根据上交所官方信息,燧原科技科创板首次公开募股申请已获通过,拟募资60亿元。这意味着,国内GPU领域四大领军企业——摩尔线程、沐曦股份、壁仞科技、燧原科技有望在资本市场实现集体亮相。宜兴市国有资本运营集团,正是这一征程的早期参与者与重要受益方。回溯至2022年,国控集团便联合IDG资本等专业风险投资团队,深度布局燧原科技,抢占国产AI算力领域制高点。战略眼光决定发展高度。燧原科技创建于2018年,深耕八年,自主研发迭代四代架构、五款云端AI芯片,形成了涵盖AI芯片、AI加速卡、智能计算系统集群

2026-06-16 09:33:05  |  10 阅读