千问携手Bose推出AI智能体耳机,具备实时翻译能力
7月17日,2026世界人工智能大会首日,千问品牌旗下首款AI智能体耳机正式发布。这款智能耳机由千问与Bose联合研发,Bose专业声学团队进行音质调校,实现高保真音效平衡,兼顾开放式耳夹的佩戴舒适度与音质表现。耳机采用适合长时间佩戴的耳夹式造型,内置千问AI助手核心功能,支持实时翻译、会议记录、健康监测等应用,带来更自然、流畅的AI交互感受。这款耳机还能与千问眼镜协同工作,眼镜负责捕捉用户视线,耳机负责接收声音,可深度融入用户日常生活,实现随时随地的智能响应。值得关注的是,千问AI眼镜也同步升级为智能体
AI耳机:贴身的智能伙伴
阿里推出一款AI耳机,或将成为首款你愿每日佩戴的智能硬件。阿里千问团队研发的这款AI智能耳机,即将在WAIC上正式亮相。它并非普通蓝牙耳机,内置大模型,支持实时翻译、语音对话与录音备忘,无需联网,佩戴即用。耳机形态极具优势。手机无法时刻手持,耳机却可长期佩戴。将AI融入其中,等于随身携带翻译官、秘书与对话伙伴,比智能音箱更贴近人体,比AI眼镜更像日常必需品。同日,另有消息称,某企业智能眼镜芯片实现突破,已进入主流手机厂商供应链。耳机与眼镜,正双线并进。两条线索指向同一趋势:AI正从"数据中心
扔掉翻译工具!AI眼镜实时同传功能成旅行必备神器
海外旅行或参与国际商务会议时,你是否还在慌乱地翻找手机、启动翻译应用,然后难堪地将屏幕展示给对方?在2026年的当下,这种交流模式早已过时。伴随终端计算能力和音频技术的飞跃,即时同声传译,已正式成为AI智能眼镜的“核心王牌功能”!技术核心1.无缝即时对话,跨越语言鸿沟依靠头部企业(例如Meta、Rokid等)在本地AI(终端处理能力)领域的突破,如今的智能眼镜已大幅减少对云端的依赖。这代表什么?代表近乎无感的延迟!当外国朋友向你说话时,眼镜的多麦克风系统会即刻捕捉语音,并实时在你耳畔播放翻译好的母语。你只
AI赋能电信诈骗:一人操控百人对话,效率翻倍
相关记录表明,一名诈骗分子能够同时与超过100名对象进行交流,成交周期由原本的7天缩短至4天。TRM Labs的阿里·雷德博德直言不讳地指出:"我们正在步入一个或许不再需要人类骗子的时代。"过去从事诈骗活动主要依赖人海策略。一人锁定一个目标,通过反复沟通逐步建立信任关系,整个过程短则数周,长则可达数月。如今,AI大模型已成为核心生产工具:支持上百种语言实时互译,能够针对不同受害人自动生成个性化话术,一名电诈从业者即可同时应对上百名受害者。当你还在琢磨如何用AI撰写周报时,诈骗团伙早已在探索
AI行业双周报:2026年6月中旬技术革新与资本市场新动向
平头哥 AI 观察 · 2026年06月15日 技术升级 Google 发布 DiffusionGemma:扩散模型提速4倍 Google 于6月10日发布 DiffusionGemma 模型,采用扩散技术路线而非传统自回归架构,文本生成速度提升4倍,已在 Google AI Studio 和 Vertex AI 向开发者开放。扩散模型路线与大语言模型路线形成竞争,代码生成、长文本写作等场景有望实现更低延迟、更高吞吐量,同时降低算力消耗。对关注 AI 应用落地的开发者而言,这是值得关注的新技术选项。 Ge
科大讯飞推出全新智能AI眼镜
近期,科大讯飞于澳门隆重推出了全新的讯飞AI眼镜,向大众呈现了该款产品在全方位同传、智慧提词、GlassClaw智能助手以及仅40克的极致轻盈设计等方面的突出优势。这款AI眼镜具备122种语言的同步传译能力,融合了语音通话翻译、当面交谈翻译以及图像视觉翻译等多种应用模式。设备配备了多重麦克风组合与底层算法相配合的深度降噪模块,并开创性地加入了视觉降噪机制。在人声鼎沸的复杂场景中,借助唇语动作识别技术,能够实现高精度的声音捕捉,完美解决诸如展会、商业街区、社交宴会等喧闹场所的交流障碍。此外,该产品还自带智慧
科技前沿:OpenAI 造机器人,苹果联姻 Gemini,阿里 Qwen 牵手欧足联
OpenAI 正式组建机器人部门,将具身智能重归核心战略;苹果备战 WWDC,拟通过 Gemini 蒸馏模型升级 Siri,兼顾端侧隐私与云端算力;Google 将 Nano Banana 图像系列投入生产,推动生成能力从演示转向 API 服务;OpenAI 发布实时翻译模型并适配智能眼镜,语音交互迈向随身化;阿里云携 Qwen 成为欧足联官方伙伴,AI 技术深入全球体育运营体系。OpenAI 重兵布局机器人赛道OpenAI 已正式成立 Robotics 团队,广泛招募涵盖硬件、系统及机器学习的全栈工程师
AI日报速递|5月30日|OpenAI进军实时翻译,专用模型成新趋势
各位好,欢迎来到StarAI资讯站。今日AI圈相当精彩,OpenAI放出了大招,直接切入实时翻译领域。与此同时,国内这边,阶跃星辰也开源了一款性价比超高的Agent模型。接下来我们逐一了解。先快速浏览一下今日要点。第一,OpenAI推出了实时翻译模型,支持70种语言输入,翻译成13种输出语言。我认为这个信号比产品本身更值得关注,因为OpenAI正在走专用模型路线。第二,阶跃星辰开源了Step 3.7 Flash模型,近2000亿参数,但实际只激活110亿。在Agent评测中位居榜首,还能在Mac上本地运行
AI简报 | 5月30日:OpenAI发布多语言实时翻译系统
2026年05月30日 星期六 有料哥每日精选 · 不废话,只给干货2026年05月30日 星期六有料哥每日精选 · 不废话,只给干货👊 有料哥日报:OpenAI的翻译模型、小米的音效生成、阶跃星辰的智能体——今天AI圈集体“卷”效率,但最炸的是Codex终于学会自己管线程了。别吹什么“理解世界”,先让AI别在并行任务里卡死再说。👊 有料哥日报:OpenAI的翻译模型、小米的音效生成、阶跃星辰的智能体——今天AI圈集体“卷”效率,但最炸的是Codex终于学会自己管线程了。别吹什么“理解世界”,先让AI别在
科大讯飞推出超轻AI眼镜,4299元开启预约
新浪科技讯 5月29日下午消息,BEYOND Expo 2026上,科大讯飞(47.900, -1.23, -2.50%)推出了讯飞AI眼镜。据透露,这款眼镜整机重量仅40克,比同类竞品轻约两成,定价为4299元,目前全平台已开放预约优惠,并将于6月15日正式启动预售。 功能方面,讯飞AI眼镜具备122种语言的实时互译能力,翻译字幕可直接显示在镜片上,同时通过扬声器同步播报译文,使跨语言交流如同母语对话般顺畅自然。在发布会现场,主讲人借助眼镜与一位西班牙语用户进行了远程通话,全程无需依赖手机或任何第三方设
腾讯会议AI同传功能正式发布
有朋自远方来,不亦乐乎?今日,腾讯会议AI同传功能正式登场,首批支持中文与英文的双向翻译。每位参会者,都将拥有一位专属的AI同传译员。无论是跨国商务谈判、跨洋团队协作还是跨国社交往来,在“听”与“说”方面都将变得更加轻松:无需会前临时抱佛脚背单词、无需紧急联系翻译人员、无需听不明白还装作若无其事地点头。传统的同传模式如同接力赛——发言人完整说完一句后,译员才能开始翻译,对话节奏被迫分割成两部分。腾讯会议将AI同传的延迟控制在3秒以内,发言与翻译几乎同步进行,无需等待、无需憋屈,跨语言交流可以像母语对话般自
2026年AI穿戴设备实测:眼镜、戒指、挂件究竟值不值得入手?
2026年如果你还在犹豫要不要入手一台AI手机,可能已经out了。因为今年真正火起来的赛道是——AI可穿戴设备。Era这家公司刚拿到1100万美元融资,做的就是AI小工具的操作系统。Meta的Ray-Ban智能眼镜已经卖出几百万副。就连我一直觉得有点鸡肋的AI戒指,也有不少创业公司在深耕了。作为一个数码发烧友,我基本把市面上能买到的AI可穿戴设备都体验了一遍。今天聊聊真实感受。AI可穿戴设备 — 眼镜、戒指、挂件正在成为新潮流先说最成熟的品类——AI眼镜。Meta和Ray-Ban联合推出的智能眼镜,到20
OpenAI 推出语音模型新系列,同传行业受冲击?
语音技术的迅猛发展,正逐渐改变翻译行业的未来走向。5月7日,OpenAI 推出了全新的语音模型系列,其官方博客将其定义为「专为实时语音场景打造的新一代模型」。该系列包含三个子模型,分别针对推理、翻译和转写任务进行了专项优化,目前 API 已开放调用。01 三款模型各司其职此次发布的三款模型分别为:实时推理模型(主打低延迟对话)、翻译模型(实现多语言即时互译)、转写模型(追求高准确率语音转文字)。OpenAI 在博客中强调,翻译模型的延迟已降至「用户几乎无法察觉」的程度。这种分工明确的架构设计,取代了以往「
苹果AI耳机亮相:AirPods能否成为下一代智能入口
今年2月Tim Cook曾暗示苹果正在研发由AI驱动的“全新品类”产品,当时多数人猜测是智能眼镜——然而率先登场的却是AI耳机。苹果计划将AirPods从单纯的“音乐播放设备”转变为“环境感知助手”:实时翻译、会议记录、场景识别等功能一应俱全,你的耳朵或许会比眼睛更早迈入AI时代。📅 发布时间:2026年5月15日⏱️ 阅读时长:约4分钟🏷️ 文章分类:#硅基觉醒 #苹果AI #可穿戴设备1. AI耳机具备哪些功能环境感知:能够识别所处环境(如餐厅、办公室、户外),自动调节降噪模式并提供个性化推荐;实时翻
OpenAI发布三款全新音频处理模型
01三款新模型分别是什么?首先是GPT-Realtime-2,这是OpenAI首款具备GPT-5级别推理能力的语音模型。它专为实时语音交互设计,能在处理请求的同时保持对话流畅。其核心升级包括:上下文窗口从32K扩展至128K,支持更长的对话和更复杂的任务流;支持并行工具调用,可同时处理多个后台请求;具备更强的错误恢复能力,遇到问题时能主动告知而非直接中断。该模型还提供minimal、low、medium、high、xhigh五档推理强度调节,开发者可以在延迟和推理深度之间灵活平衡。其次是GPT-Realt