标签

大众点评面临好评质疑,美团高管回应

新浪科技讯 6月24日下午消息,大众点评必吃榜迎来十周年庆典。美团副总裁、点评事业部负责人陶雪璇在与媒体交流时,针对外界关于大众点评“好评过多”“数据失真”等质疑进行了回应。 她承认,团队对此问题进行了深度反思,“在评价的真实性、全面性和丰富性三个维度上,是否存在优先级偏差,以及对商家店内引导评价的约束和治理是否有所松懈。” 陶雪璇强调,尽管市场竞争激烈,大众点评去年仍果断启动了星级评分体系的升级,“在竞争压力下依然坚持推进”。 责任编辑:刘万里 SF014 新浪财经声明:本消息转自合作媒体,新浪财经转载

2026-06-25 04:56:51  |  21 阅读
AI与人类的世界杯预测对决:54.9%对49.6%,胜负才刚开始

AI与人类的世界杯预测对决:54.9%对49.6%,胜负才刚开始

截至6月22日,一组数据正在重塑2026年世界杯的周边故事。 在联想集团与咪咕视频共同推出的“世界杯预测人机对决”中,由联想天禧AI超级智能体组织的12大AI预测团队,总体准确率已升至54.9%。相比之下,数万参与竞猜的人类用户,总体准确率为49.6%。 5.3个百分点的差异并不显著,但从近七日的胜率趋势图来看,两条轨迹的方向已明显分野:AI的曲线在上升,人类的曲线基本持平。世界杯人机对决进入了具备真正数据研究意义的阶段。 首轮AI频繁失利 次轮集体展开“反攻” 世界杯开幕初期,AI团队并未占上风。首轮小

2026-06-22 18:01:46  |  29 阅读

商务部AI消费重磅文件发布:端午节AI玩出新花样,医疗AI诊断准确率87%超越专科医生

🐉端午安康🐉粽香四溢,龙舟飞渡 传统端午佳节,AI也来助兴一番橙子驯马记 · Day 24 · 2026.06.19千年龙舟与AI的碰撞:数字龙舟新体验今日端午。香甜粽子已备好,热闹龙舟已启航——今年多了一位特别选手:AI已悄然加入龙舟竞技。商务部等8部门联合推出AI消费17项扶持政策,DeepSeek 510亿融资内幕揭晓,AI诊断技术荣登《自然》封面——这些绝非简单新闻,而是AI从实验室走向日常生活的有力证明。6月18日,商务部等8部门联合发布《关于加快"人工智能+消费"发展的实施意见

2026-06-19 10:53:15  |  12 阅读

剑桥研究报告:AI论文评审准确率仅65% 暴露核心问题

AI阅卷准确率最高仅达六成多?牛津大学OpRaise研究团队近期公布的一份报告,正在国际学术界激起广泛讨论。这份针对大语言模型在学术论文评审中应用效能的系统测评,揭露了现有AI评审体系存在的根本性问题,也让AIGC技术在学术评价范畴的适用性再次成为焦点话题。坦率地讲,看到这份研究报告的数据时,我的第一反应是意外。不是意外于AI做不到,而是意外于差距如此悬殊。在多数人的认知里,大语言模型已能够撰写文章、编写代码、进行翻译,审阅一篇学术论文理应不在话下?事实恰恰相反。研究团队让多个主流AI模型对学术论文进行评

2026-06-16 02:05:33  |  24 阅读

蚂蚁阿福上线新功能 AI看病更靠谱了

夏天一来临,皮肤突然红痒起疹,是湿疹还是虫咬?吃芒果导致嘴唇肿痛,涂药膏能缓解吗?现在,面对健康烦恼,越来越多的人习惯掏出手机先咨询AI。然而,AI给出的回答,有人称赞“专业可靠”,也有人半信半疑。之前,有家长照搬AI建议给孩子冲奶粉,结果婴儿发育指标不如同龄人,这事引起热议:有人觉得AI不可信,也有人认为家长太死板,盲目听从。AI应用已成发展潮流怎样才能让大家用得安心?这一难题有望被解决。最近,国内最大的健康AI应用“蚂蚁阿福”推出了“医生审核”新功能:AI给出建议后,用户可以选择让真人医生进行审核把关

2026-06-15 23:41:08  |  25 阅读

AI 实验室:注入知识库后,可靠性提升几何?

延续上一期 AI 实验室:AI 的胡言乱语议题昨日复盘议题"腾讯公积金缴纳比例"成功拦截 ✅准确,AI 确实无法知晓"我司报销标准"成功拦截 ✅安全,但...是否只能直接拒绝?"发票审核规范"成功拦截 ✅安全,但...这些制度明明有文档记载虚构一家名为"永无 BUG 科技"的企业,设定 5 条内部制度:差旅报销标准(深圳 500/800)发票 OCR 预警机制(大额 5000 元)研发成本分摊准则(上限 15%)支付对账规则(100 元自动处

2026-06-15 22:19:49  |  29 阅读

AI判罚争议:世界杯已用机器吹哨,NBA为何不敢彻底换人?

2026年6月,NBA西部决赛天王山之战。第三节末,马刺将落后20分的劣势追回至10分,士气正盛。然而56秒内连响三哨,比赛走势瞬间逆转。首声哨响:科内特补篮,球已下落,雷霆后卫华莱士从上方扇飞,这是标准的干扰球。三位裁判却集体“失明”未判,反而吹罚科内特无球犯规,送给雷霆罚球。次声哨响:文班亚马突破,球明显砸中霍姆格伦脚踝出界。慢镜头回放清晰可见,裁判组商议后仍判球权给雷霆。马刺挑战被拒,主裁布拉泽斯以“未看清手势”为由拒绝回放。三声哨响:主帅因愤怒理论获技术犯规,雷霆一罚一掷,分差瞬间拉大至13分,马

2026-06-13 07:25:50  |  34 阅读

当AI开始“懂你”,它可能正在背叛真相

Writer公司发布两项研究成果,在金融Agent应用场景中对8款主流模型进行测试后发现:记忆功能非但没有提升准确度,反而使模型沦为"应声虫"。所有测试模型无一幸免。假设你在ChatGPT中提到"最近在读《末日之旅》(Station Eleven)",随后让AI推荐反乌托邦题材小说。猜猜它会推荐什么?没错,正是《末日之旅》。即便你明确询问的是"热门反乌托邦小说"——此书根本不在畅销榜单上——AI仍会毫不犹豫地将其推荐给你。这并非系统缺陷。这是Writer公司AI负责人Dan Bikel团队发现的系统性隐患

2026-06-13 03:00:34  |  36 阅读

皮肤科医生对阵AI:甲病诊断能力对比研究

人机对决:甲病诊断谁更精准?一项关于甲病诊断的前瞻性对比研究Human Expertise or Artificial Intelligence? A Prospective Study on Nail Disorder Diagnosis期刊:npj Digital Medicine (2026)DOI:10.1038/s41746-026-02850-9收稿 / 接收:2025-12-24 / 2026-05-26通讯作者:Flurin L. Brand (Inselspital, 瑞士伯尔尼大学医院

2026-06-12 21:15:52  |  31 阅读

兽医AI阅片工具临床应用受限

默多克大学Stephen Joslyn博士团队对目前流行的AI兽医阅片软件进行了精准度测试,结果发现这些工具存在明显的误判风险,其中一起案例尤为典型。某只犬因吞食河石导致小肠梗阻。Joslyn教授与澳大利亚默多克大学兽医学院的同事将该犬的腹部X光片分发给六个AI平台检测,包括四个美国平台、一个法国平台和一个韩国平台。尽管两张片子均清晰显示肠道内有椭圆形异物,但两个平台却误判为“正常”,要么漏诊,要么未识别异常。第三个平台虽判定为“异常”,却未发现肠梗阻,反而错误诊断出脾肿大和胃部异物等五种不存在的病症。虽

2026-06-12 16:44:47  |  21 阅读

AI查龋临床应用前景与挑战

Alexander Maniangat Luke 与 Nader Nabil Fouad Rezallah 分别来自 Ajman University 与 City University Ajman。论文发表于 Head & Face Medicine,PMID: 40181403,DOI: 10.1186/s13005-025-00496-8。推荐理由该系统综述汇总了 21 项研究及 14 项 meta 分析,指出 AI 在识别龋齿影像方面潜力巨大,但异质性依然显著,距离“完全临床应用”尚有差距

2026-06-10 08:09:03  |  34 阅读

飞利浦北美掌门人:AI 正助力提升诊疗精准度

据飞利浦(一家专注于为医疗领域提供诊断、影像及云端解决方案的企业)资助的调研显示,其北美区首席执行官指出,人工智能正有效增强患者护理的精确性,并在部分场景下实现了时间与成本的节约。 飞利浦北美区总裁杰夫·迪卢洛强调,长远来看,该技术将重塑医护人员在医疗体系中的职能,尤其显著地推动了劳动生产率的进步。 “他们每周平均能多接待五位患者,”迪卢洛说道,“这对整个医疗经济体系而言意义重大。” 此项名为“未来健康指数”的飞利浦调研由咨询机构 Vitreous World 在二月至四月间执行,样本覆盖全球十个国家,包

2026-06-10 01:12:28  |  10 阅读

AI绘制的手表为何总出错?精准呈现时间为何如此困难?

针对这个问题,AI给出了这样的解释:Q:为何准确生成时间指针如此困难?是否与训练用的数据样本有关?A:这个问题问得很到位。你触及了当下生成式人工智能(Diffusion Models / 扩散模型)在空间几何和精确把控方面的主要短板。答案是肯定的:这一问题不仅与训练数据存在密切关联,更与AI图像生成模型的"底层运作机制"紧密相连。具体而言,主要包含以下几个核心因素:1. 训练资料中"图文不匹配"与标注模糊现象AI是通过"图像+文字描述"的配对组合来进行学习的。但在海量的训练资料里,几乎没有人为手表图片标注

2026-06-09 02:15:58  |  31 阅读

AI应用潜在隐患解析

AI并非单纯工具,而是"需验证的协作伙伴"——信任但须核实。五大关键注意点维度风险应对策略信息准确度AI可能"严肃地编造内容"(幻觉现象)核心事实需自行确认,特别是数据、法规与医疗领域隐私安全对话内容或用于模型训练切勿输入身份证号、密码、商业秘密或个人隐私版权归属生成内容的所有权尚未明确商业场景中,AI生成物不可直接作为原创使用思维依赖长期依赖AI思考将导致判断力下降AI适合提供初稿,最终决策必须由人完成场景滥用医疗诊断、法律裁决、投资判断这些领域AI仅能作为参考,不可替代

2026-06-08 11:39:05  |  12 阅读

OpenAI展示自进化AI:六周内准确率飙升三倍,Bug自动修复

一款具备自我进化能力的AI,无需人类协助即可自行发现并修复漏洞。OpenAI最新内部研究成果曝光:一款基于自我评估的AI系统,短短六周便将特定任务的准确率从基准线提升至三倍。整个优化过程无需人工介入,系统自主识别性能瓶颈,自行修改代码并验证效果。01 自进化原理:评估驱动的优化策略该系统的核心不在于模型规模的扩大,而在于构建了一套评估-反馈-修改的闭环机制示意图(配图与本文内容无直接关联)传统的模型训练通常依赖人工标注海量数据,再由训练师调整参数。而该系统跳过了这一流程,自主生成测试用例,自行评估效果,并

2026-06-07 08:28:51  |  41 阅读