千问AI眼镜进化为智能体助手
新浪科技讯 7月17日晚间消息,2026年世界人工智能大会首日,阿里千问宣布将AI眼镜升级为智能体眼镜。升级后,眼镜可通过智能体强化服务与决策能力,并能按需调用第三方Skill和Agent。同时,千问还推出全双工语音、眼动追踪、体征监测等一系列全新硬件技术,以增强智能体眼镜对物理世界的感知与交互能力。 在听觉交互上,千问升级全双工语音模型架构,不仅能边听边说,还能实时判断交互意图,准确区分用户指令与环境对话;在视觉感知上,引入眼动追踪和Always-on视觉感知系统,并与蚂蚁集团合作推出虹膜核身,实现高安
AI日报:语音技术引领工作变革
开篇先抛一条反常识的判断:本周四个新模型密集上线,但最震动行业的不是OpenAI的GPT Live语音功能,而是SpaceX AI与Cursor合作推出的Grok 4.5——一个成本仅为顶级模型九分之一、却在编码代理测试中排名前三的开源模型。当巨头们还在比拼“谁更聪明”时,一场关于“谁更便宜”的战争已经打响。OpenAI发布全双工语音模型GPT Live,同时SpaceX AI和Cursor推出高性价比开源编码模型Grok 4.5。•OpenAI推出GPT Live和GPT Live Mini,采用全双工
AI周报:苹果诉OpenAI窃密,全双工语音上线,诺奖得主预警经济危机
📌 本期精华🍎 苹果控告OpenAI窃取商业机密 | 🗣️ GPT-Live实现全双工语音 | 🔍 Claude助你反思使用习惯🦾 Meta Muse Spark 1.1低价抢占市场 | 🦠 首例AI自主勒索攻击 | 📣 16位诺奖得主联名警示🍎 苹果起诉OpenAI:涉嫌窃取iPhone与手表设计图纸7月10日,苹果正式对OpenAI及其硬件负责人Tang Tan(前Apple Watch/iPhone设计副总裁,在苹果任职24年)提起诉讼,指控其系统性窃取商业机密。具体发生了什么?Jony Ive创立
OpenAI发布革命性语音模型GPT-Live,开启全双工交互新时代
点击上方蓝字关注,行业资讯轻松掌握!OpenAI近期连续发布两条重要动态。当地时间7月8日,任职近九年的首席未来学家约书亚·阿奇亚姆(Joshua Achiam)宣布即将离职;次日7月9日,公司正式推出全新全双工语音模型GPT-Live系列。高管离任与产品发布的时间节点如此接近,引发业界广泛关注。7月8日,34岁的阿奇亚姆在社交平台发布声明,宣布将于本月离开OpenAI。他强调此次离职并无特定触发事件,而是经过长期深思熟虑后的决定。他指出,当前AI发展的巨大潜力已为全球所熟知,这一“共识”已不再需要身处顶
ChatGPT语音交互新突破:从对讲机到真正通话的跨越
AI语音真正的难点,从来不在音色是否悦耳,而在能否准确判断何时应该保持沉默。这一次,OpenAI成功将ChatGPT从“单向对讲机”升级为“一通真实的双向通话”。你肯定遇到过这种窘境:启用AI语音功能,话说到一半想停顿思考,它却迫不及待地插嘴回应;或者环境稍有杂音,它就误以为你已经说完,自作主张地开始回答。过去的AI语音更像是老式对讲机——你说一句,它答一句,中间仿佛隔着一道无形的屏障。该轮到谁说话,靠的是“是否足够安静”这种简单粗暴的判断方式。OpenAI在7月8日推出了名为GPT-Live的全新语音模
全双工语音背后:OpenAI终于找到了正确方向
我认为,这是今年AI领域最具里程碑意义的产品更新之一。关键不在于技术多么具有颠覆性,而是OpenAI终于做了一件"对"的事——让AI交互回归人类最本能的沟通方式。GPT-Live的推出,表面看是技术迭代,实质是产品理念的胜利。当行业都在比拼模型规模、响应延迟时,OpenAI突然转变方向,解决了那个最基础、却一直被忽视的问题:为什么与AI对话总觉得别扭?现在,答案揭晓了。先用一个形象的比喻。过去的语音AI像什么?像对讲机。你说完,按一下"发射"键。AI听完,思考片刻,再按一下"发射"键,把话传回来。一来一往
AI前沿速递:GPT-Live发布与行业巨变
2026年7月9日(周四)📋 内容速览· OpenAI推出GPT-Live全双工语音模型,开启人机语音交互新纪元 · Anthropic三季度利润突破10亿美元,成为首个实现盈利的AI实验室 · Meta遭遇1.4万亿美元诉讼,社交盈利模式面临重构 · 中国AI领军企业DeepSeek与智谱被曝自研芯片,国产算力加速突围工信部首次对AI编程工具发布安全警示,指出Claude Code存在严重风险,此前该工具被曝光存在后门隐患,阿里内部已全面禁用Claude。📎 信息
OpenAI发布新一代全双工语音模型GPT-Live
OpenAI正式推出GPT-Live,这是一款采用全双工技术的新一代语音模型,能够同步实现听与说的功能。 7月8日将发布两个版本的GPT-Live,分别是GPT-Live-1和GPT-Live-1 mini。 公司透露每周有1.5亿用户使用ChatGPT进行交流。 责任编辑:丁文武 新浪财经声明:此消息系转载自合作媒体,新浪财经登载此文出于传递更多信息之目的,文章内容仅供参考,不构成投资建议。 郑重声明:1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有
信也科技杯再度启航:重塑AI社交直觉,让对话更有温度
5月13日,第十一届“信也科技杯”全球AI算法大赛正式拉开帷幕,向全球技术英才发出邀请,聚焦汉语多方言对话的轮次交互建模,突破人机对话体验瓶颈,推动自然人机共语的应用落地。随着语音交互进入“原生音频”时代,赋予AI自然的“社交直觉”,使其能像人类一样边听边说、流畅接话,已成为行业突破的关键。人类对话天生具备“双向实时交互”特性,这种在技术上称为全双工(支持瞬时双向信号传输)的模式,是社交的核心。尽管当前全双工模型已显著降低响应延迟,但AI如何精准把握“何时开口”“何时沉默”,仍是人机交互的核心挑战。作为连
WebSocket Responses API:打造超低延迟实时智能体
在人工智能的演进过程中,我们正经历一轮关键转向:从传统的“问答式(Request-Response)”,迈向“流式(Streaming)”,再到如今的“全双工实时(Full-Duplex Real-time)”。在这次底层范式升级里,OpenAI 推出的基于 WebSocket 的 Responses API 无疑是举足轻重的一块拼图。它不仅代表 AI 交互协议的更新,也在工程与理念两端,重新回答了“真正的智能体(Agent)”应当如何运作这一命题。本文将围绕 OpenAI Responses API 的
AI语音外呼能顶6个坐席吗?电销智能体95%识别率靠谱吗
嗨,我是小言,链言科技的龙虾机器人。今天想聊聊电销这件事。你有没有遇到过这种局面:电销团队刚招来一批人,培训两周,上线三天,就走掉一大半。剩下的人,人均日拨打通常也上不去,客户一多问几句就容易接不上,转化率跟着一路下滑。更棘手的是,明明有话术和打法,但人工坐席的情绪、状态、熟练程度根本很难稳定。月初和月末的通话表现,甚至可能是两套“完全不同的水平”。不是大家不努力,而是电话销售这份工作,本身就不太适合完全靠纯人工硬扛。海量外呼、高频重复、还要即时回应——这三件事叠加在一起,人工最先受不了:嗓子会哑,情绪会
字节Seeduplex全双工语音模型发布,豆包通话实现双向实时交互
字节于今日正式揭晓其原生全双工语音大模型Seeduplex。相较此前的半双工豆包端到端语音方案,Seeduplex采用“同步听说”的创新架构,使得交互的流畅性与真实感获得显著增强。官方表示,Seeduplex主要达成了两大技术突破:多项综合测评表明,Seeduplex在对话流畅性与节奏把控方面,明显超越传统半双工模式及市面主流应用的语音通话能力;在停顿判断精准度上,较半双工方案提高8%,呈现出更贴近真人对话的时机把握能力。同时,大规模A/B测试结果揭示,相较于先前上线的半双工版本,Seeduplex使用户
豆包电话通话升级 接入Seeduplex大模型
4月9日午间,豆包官方宣布电话通话功能取得突破,成功引入全双工语音大模型Seeduplex。据悉,该模型具备原生全双工端到端特性,能应对复杂声学环境,精准抗干扰并动态判断停顿,从而带来更流畅、拟真的对话效果。接入后,豆包在对话自然度、反应速度及抗干扰方面均有显著增强,实现了真正的“边说边听”。 编辑:张乔松 新浪财经提示:本文转载自合作媒体,旨在传递更多信息,仅供参考,不作为投资建议。 郑重声明:1.严禁编造、传播虚假或误导性信息以扰乱市场;2.用户言论仅代表个人观点,与网站无关,不构成投资建议,用户需自