标签

4月AI模型进展盘点

📰 模型支持 2M token 的长上下文能力,采用 Symphony 架构(原生多模态 + 双系统推理)整体性能提升约 40%,Altman 将其称为"AGI 最后一公里"推出 V4-Pro(1.6T 参数)与 V4-Flash(284B 参数)两条路线将 1M token 上下文设为默认配置,1M token 的价格约为 1 元Ultra-MoE 架构:总参数规模达 1T,实际激活区间为 130-370B关键在于全面适配华为昇腾,真正摆脱英伟达 CUDA 依赖通过群体记忆蒸馏,将 8

2026-05-07 22:12:27  |  9 阅读

AI视觉识别赋能智能仓储:WMS系统应用场景解析

AI+智能仓储:WMS+AI图像识别应用场景详解 AI+制造应用场景 | 方向五AI+智能仓储:WMS+AI图像识别应用场景详解AI+制造应用场景 | 方向五上个月,佛山一家家电企业的仓储主管王经理给我打了个电话:"我们上了WMS,但库存准确率还是只有89%。问题出在哪?" 我问他:"你们怎么盘点?"上个月,佛山一家家电企业的仓储主管王经理给我打了个电话:"我们上了WMS,但库存准确率还是只有89%。问题出在哪?"我问他:"你们怎么盘点?"AI图像识别+WMS:怎么解决问题? 王经理后来上线了一套AI图像

2026-05-07 19:15:36  |  19 阅读
美媒披露:美伊冲突致至少228处美军设施受损

美媒披露:美伊冲突致至少228处美军设施受损

新华社北京5月7日电美国《华盛顿邮报》6日披露,通过卫星影像分析发现,自今年2月底美伊冲突升级以来,美军在中东的军事据点已有至少228个“结构”或装备部件遭到破坏,涵盖机库、营房、油库、战机及雷达、通信和防空系统等。这一破坏规模远超此前美国政府或媒体公开承认的程度。 此次分析对比了伊朗媒体发布的128幅高分辨率卫星影像、欧盟“哨兵-2”卫星数据及美国行星实验室公司的图像。结果显示,109幅影像被确认为真实,19幅无法证实。未检测到造假迹象。此外,行星实验室的数据还额外发现了10个已损毁却未被伊朗媒体曝光的

2026-05-07 16:58:53  |  39 阅读

AI日报速览:语音输入上新,全模态与AI搜索升级

1.千问PC端上线AI语音输入功能,用户可通过快捷键在各类桌面应用中直接使用,具备出色的语义理解能力,能把口语内容整理成结构化信息,同时还能用语音指令完成多种办公操作,显著提升日常效率。亮点提要:🗣️ 千问语音输入可对口语内容进行去语气词、纠错与格式化整理,并能结合上下文进行更贴合的回应。📝 用户能够用语音指令直接在多种应用里调用千问,实现创作、问答、翻译等常见任务。📧 千问还能自动生成邮件回复,覆盖钉钉、微信或邮件等办公场景,帮助用户更快处理沟通。2.字节跳动发布全模态大模型Doubao-Seed-2.

2026-05-07 16:32:09  |  10 阅读

AI核心两学法:深度与监督

接着把AI领域最关键的两条技术分支继续拆开——深度学习与监督学习。用更好懂的类比,帮你迅速抓住它们的本质!三、深度学习(Deep Learning, DL)📌 一句话定义深度学习属于机器学习的一种实现形式,利用多层神经网络完成学习,也是推动当下AI快速发展的关键力量。🎯 生活类比假设你要培养一个孩子去分辨不同的动物。传统机器学习:你把规则直接告诉他,比如“兔子的耳朵长,长颈鹿脖子更长”,让他记住这些外观线索。深度学习:你不断给他展示海量图片,他的“大脑”(由多层神经元搭建的模型)会自动从最基础的信号开始提

2026-05-07 09:04:44  |  13 阅读

AI加持自媒体:第三期OPC超联体AI应用分享回顾

2026年5月1日晚,第三期OPC超联体前沿AI应用分享会在网上顺利举办。本期内容围绕“AI+自媒体”的全链路落地展开,同时也是OPC超级个体训练营AI+自媒体专场的营前培训。现场共有8位伙伴分享实践经验,涵盖图像创作、Skill开发、代码工具、视频自动化、动画生成、拆解对标博主、个人IP塑造以及虚拟IP口播等方向。AI+自媒体并不只是写出一篇文案,或是简单生成几张图片。更关键的是让AI真正进入选题、创作、设计、视频制作、分发以及复盘的完整流程,把AI变成创作者身边一套可反复使用的工作流。对未来的自媒体创

2026-05-06 17:38:46  |  24 阅读

SUS读书节|第十七讲:Qwen-Image文字渲染与高保真图像生成

SUS“AI+素养·同城共学”系列课堂本周预告(5月7日)第十七讲Qwen-Image最新模型的文字渲染与高保真图像生成5月7日 14:00张军(上海健康医学院)开源AI作图工具Qwen-Image模型,能够将图片内容中的文字精准“还原”,尤其对中文表现突出,针对AI图片里常见的文字错乱问题给出更有效的解决。无论是做海报还是日常修图,都能更快更稳地提升效果,并通过更细致的方式提升图片生成质量的可控性,从而显著降低AI生图带来的生硬感。讲座将从便捷的在线体验讲起,进一步延伸到生图模型的本地部署与参数调校,带

2026-05-06 10:46:49  |  27 阅读

AI内参:OpenAI融资1220亿,白宫拟审查,Mythos引安全震荡

OpenAI 于2026年3月31日正式敲定并完成一轮高达$1220亿的融资,投后估值随之升至$8520亿。就规模而言,这堪称科技史罕见的超大体量私募融资,几乎也接近资本市场历史上的最大交易纪录。此次融资由三家科技巨头进行锚定支持:Amazon 承诺投入 $500亿,NVIDIA 与 SoftBank 则分别出资 $300亿。除上述主体外,Altimeter、Appaloosa LP、ARK Invest、BlackRock 附属基金、Blackstone、Coatue、D1 Capital Partne

2026-05-06 06:40:34  |  19 阅读

AI资讯早报 · 2026年5月5日

每天9点,带你挑选昨日最值得关注的AI动态。本期共精选12条新闻,覆盖大模型、军事AI、资本走向与政策监管四大板块。重点信息包括:斯坦福AI报告指出中美差距仅2.7%、五角大楼签约7家AI巨头、Anthropic拟按9000亿美元估值推进融资。硅星人深度分析指出,GPT Image 2 的出色表现源于架构层面的核心调整——系统先由LLM负责语义规划,最后再由扩散组件完成像素生成。图像生成正在从"画出来"转向"理解后呈现出来"。

2026-05-06 04:19:19  |  14 阅读

精选全球顶尖AI应用指南

国内外主流 AI 工具: 文本生成 / 对话助手:用于把想法、资料、语音整理成文字。 国外:ChatGPT、Claude、Gemini;语音输入:Typeless 国内:豆包、Kimi、DeepSeek;语音输入:闪电说、豆包输入法 知识管理:用于收集、消化和沉淀资料。 国外:NotebookLM、Notion、Obsidian 国内:腾讯 ima、Get 笔记、飞书知识库 图像生成:用于生成、修改和延展图片。 国外:Nano Banana、ChatGPT 图像、Midjourney 国内:即梦 AI、通

2026-05-05 23:59:08  |  22 阅读

AI历史图像合集

AI历史图像集 锦州 , 5月3日 08:24 , 已更新关注作者其他金额¥最少打赏 ¥0确认关注作者其他金额¥最少打赏 ¥0确认关注作者其他金额¥最少打赏 ¥0确认其他金额¥最少打赏 ¥0确认其他金额其他金额其他金额¥最少打赏 ¥0确认¥最少打赏 ¥0确认锦州 , 5月3日 08:24 , 已更新锦州 , 5月3日 08:24 , 已更新已更新

2026-05-05 21:31:34  |  10 阅读

AI素养同城共学系列课堂预告(5.6-5.9)

“AI+素养・同城共学”系列课程下周安排(5月7日)1第十七讲Qwen-Image最新模型:文本渲染与高保真图像生成5月7日 14:00张军(上海健康医学院)开源绘图利器Qwen-Image能够把图片中的文字“精准写出”,尤其在中文场景表现突出,针对AI出图时易出现文字错乱的问题提供了有效方案。借助它制作海报或进行修图更高效,生成效果更稳,且能更细致地把控图像生成质量,从而显著降低AI生图带来的生硬感。讲座将从在线体验出发,进一步讲解生图模型的本地部署流程,以及相关参数调校方法,帮助大家把AI绘图能力提升

2026-05-05 11:31:43  |  15 阅读

AI 热点速递 - 2026年5月5日

# 🤖 AI 热点速递 - 2026年5月5日 ## 🔥 重点资讯 ### 1. Sierra 获得融资金额 9.5 亿美元,企业级 AI 市场角逐激烈 - **融资金额**:9.5亿美元,总融资额突破10亿美元 - **愿景**:确立"AI 驱动全球客户体验"的标杆 - **价值**:标志着企业 AI 服务领域进入资本高度博弈时代 ### 2. OpenAI 与 Cerebras 深度结盟,后者拟启动 IPO - **估值预估**:可能达到 266 亿美元以上 - **合作紧密**:作为 AI 芯片巨头

2026-05-05 10:05:59  |  10 阅读

AI影像视频革新:虚假信息时代加速来临

近期,人工智能(AI)在视频生成领域的进展异常迅猛。首先,OpenAI推出了GPT Image 2,其全新的多图像生成功能一次可输出8张连贯的图像,分辨率最高可达2K,适用于漫画、影视剧照等多种场景。紧随其后,阿里巴巴自主研发的HappyHorse 1.0已启动内测。该工具允许创作者仅通过文字描述,便能在几分钟内生成一段3至15秒的高清视频,支持多镜头切换、剧情连贯性和自动运镜。这款名为“快乐小马”的产品在权威AI视频盲测平台AI Video Arena上曾一度位居榜首,其Elo积分超越了同级别模型,表现

2026-05-04 20:30:34  |  13 阅读

构建AI辅助病理图像标注的标准化体系

病理诊断在疾病确诊中占据核心位置,是制定临床决策的关键依据。在现代临床操作中,数字病理学扮演着不可或缺的角色,并逐渐成为实验室环境下的必备技术。全玻片成像技术的问世,让病理学家能更便捷地管理数字切片图像,并将其共享用于临床及非临床研究。与此同时,机器学习的突飞猛进促成了人工智能(AI)与数字病理学的深度融合,这开启了过去仅存在于放射学和心脏病学领域的基于图像的诊断新可能[1]。在数字病理范畴内,AI技术的迅猛进步给病理图像分析带来了颠覆性变革。AI模型在病理学的发展历程显示出清晰的技术演进路线,深刻重塑了

2026-05-04 07:12:27  |  31 阅读