标签

阿里开源千问新模型Qwen3.8Flash,性能碾压Opus4.6售价低至3%

新浪科技讯 8月26日晚间消息,阿里巴巴正式推出并同步开源千问系列最新版本Qwen3.8-Flash。该模型基于全新下一代架构打造,总参数规模达千亿级别,但运行时仅需激活60亿(6B)参数,即可实现超越Claude Opus4.6的顶尖表现,刷新了全球模型效率领域的最高基准。 由于架构与训练方法的双重革新,Qwen3.8-Flash的训练开销相较于Qwen3.7-Plus大幅缩减近九成,推理成本也显著下降,每百万Tokens输入价格低至1元、输出3元,最低价格仅为DeepSeek-V4-Flash的三分之

2026-08-26 21:10:33  |  24 阅读
DeepSeek-V4-Pro-0813正式发布:百万级上下文与近40万输出,多项成绩领先Opus-4.8

DeepSeek-V4-Pro-0813正式发布:百万级上下文与近40万输出,多项成绩领先Opus-4.8

新浪科技8月13日上午报道,DeepSeek官方API定价页面与文档更新显示,deepseek-v4-pro对应模型版本已升级为DeepSeek-V4-Pro-0813,意味着这款旗舰大模型从测试阶段迈入正式上线阶段。 根据官方定价页和文档说明,DeepSeek-V4-Pro-0813具备1M上下文窗口,单次最大输出量达384K Token,并同时兼容非思考与思考两种调用方式(默认为思考模式)。在超长代码库解析、海量文档研读以及需连续多步执行的智能体任务场景下,单次请求能够承载和产出的内容量显著提升,有效

2026-08-13 09:50:06  |  28 阅读

AI日报|Opus 4.8称霸编程界,Mistral转型全栈挑战OpenAI,微软自研模型反击Claude Code

01Opus 4.8封王编程,41天一代 02Mistral变阵全栈,拉空客宝马 03微软自研编程,先砍Claude Code 04NVIDIA N1X让PC换Arm心 05Anthropic $650亿逼近万亿 06Snowflake AI涨34%锁AWS 07Siri跑Gemini了,WWDC倒计时 08AWS重写搜索,Agent流量逼的 09孙正义€750亿欧洲建算力集群 10GREYVIBE用ChatGPT发动攻击 11DynoSim把部署试错快1500倍 12Claude Code日增300星霸

2026-06-01 13:09:52  |  28 阅读

Anthropic发布Opus 4.8模型

上周末,海外人工智能领域再次传来重大动态:Anthropic推出了全新的Opus 4.8大模型。了解AI的人都知道,Anthropic是OpenAI最强劲的竞争对手之一,其每次更新都会引领行业趋势,此次迭代更是直击商业化应用的痛点,属于实质性的技术飞跃。本次新版本主要聚焦于三大核心领域:首先,代码能力。过去许多大模型生成的代码运行时常漏洞百出,处理复杂项目时更易出错。此次Opus 4.8着重提升了编码可靠性,长代码及多模块工程逻辑更加稳健,语法与运行稳定性显著增强。终端用户可将其用于开发、自动化工具及后台

2026-06-01 08:00:03  |  68 阅读
Anthropic拟数周后解禁类Mythos高危AI模型

Anthropic拟数周后解禁类Mythos高危AI模型

Anthropic PBC 打算在数周内全面推出新款人工智能模型,其安全防护实力将比肩 Mythos。 Anthropic 之前曾宣称,Mythos 风险过高,不宜面向大众开放。 该企业周四透露,因在构建“更严密防护机制”上取得“迅猛突破”,故可向全体客户开放拥有 Mythos 同等能力的 AI 产品。与此同时,Anthropic 还推出了一款名为 Opus 4.8 的新模型,其在编程任务执行方面表现更为出色。 Anthropic 此前指出,Mythos 具备“在用户指令下,发现并利用所有主流操作系统及浏

2026-05-29 03:18:57  |  26 阅读

AI 领域今日要闻速览 · 2026-05-24

今日三大看点:Anthropic亮出全部底牌(Opus 4.8曝光+Mythos 1首秀)、AI全自动科研时代开启(GPT-5.5独立改造AlphaFold2+Google单日两篇Nature论文)、AI安全防线拉响警报(四巨头联合报告:AI正在学会欺骗求生)。开发者挖掘到Claude Opus 4.8正在Google Vertex AI平台测试,51万行泄露代码表明将推出Sonnet 4.8(跳过4.7版本),专攻安全领域的Mythos 1已在Claude界面现身,预计近期商业化发布。这是Anthrop

2026-05-24 16:19:31  |  39 阅读

AI 首夺科研竞赛冠军:Opus 4.7 以 2930 步刷新世界纪录

经过 1.4 万小时 H200 算力验证及万次迭代,人工智能成功打破人类世界纪录!过去两周,Prime Intellect 实验室完成了一项壮举:将 Opus 4.7 与 Codex(基于 GPT 5.5)部署至 H200 集群,切断所有人工干预,令其独立进行 nanoGPT 速通优化。消耗 1.4 万个 H200 计算时,历经约 1 万次迭代,产生 239 亿 Token 的思考轨迹。最终结果:Opus 4.7 以 2930 步、Codex 以 2950 步的成绩,超越了人类顶尖开发者保持的 2990

2026-05-17 17:47:58  |  25 阅读

AI双雄同日对决:OpenAI与Anthropic走向分岔路

人工智能领域迎来了一场巅峰对决:OpenAI 推出 Codex 重大升级,Anthropic 发布 Claude Opus 4.7两大重磅产品同日亮相,如此戏剧性的场面,堪称罕见。先来看看 OpenAI 的这次动作。他们将 Codex 打造成了真正的 AI 协作伙伴——不仅辅助编写代码,更能操控整台计算机。Codex 新增了后台计算机操控(Background Computer Use)能力。简单来说:它能像人类一样,查看屏幕、移动光标、点击按键、输入文字。这代表着什么?多个 AI 智能体可在你的 Mac

2026-04-17 06:51:21  |  25 阅读

Anthropic发布Opus4.7升级版 网络安全性能仍不及Mythos

Anthropic PBC在限制更先进模型Mythos发布仅一周后,推出了其最强大且使用广泛的人工智能(AI)模型更新版本。Anthropic周四表示,Opus 4.7旨在提升软件工程能力,包括处理一些此前需要更多人工监督的高难度编码任务。不过,该公司称,这一新模型在整体能力上仍不及Mythos,包括网络安全相关用途方面。根据公司博客,在Opus 4.7的训练过程中,Anthropic甚至尝试通过“差异化削弱”的方式降低模型的网络攻防能力。上周,Anthropic曾警告称,其Mythos系统在用户指令下能

2026-04-16 23:58:37  |  20 阅读

Claude军师模式上线:一行代码激活Opus幕后智囊,成本大幅降低

简而言之,这是将强大的Opus模型定位为幕后顾问,而将轻量级的Sonnet或Haiku模型定位为执行者。这种组合允许开发者在极低的成本下赋予其智能体接近Opus级别的顶级智能。过去,开发者为了在AI智能和成本之间取得平衡,自行开发了一种大小模型协同工作的策略。今天,Anthropic官方将这一经验直接转化为Claude平台上的一个现成工具,只需更改API调用中的一行代码即可启用。该策略的运作机制非常巧妙。在军师策略下,Sonnet或Haiku作为执行者负责处理所有事务。它们从头到尾运行任务,调用各种工具,

2026-04-10 17:38:16  |  24 阅读

Claude上线顾问策略:小模型主攻,大模型支援,成本直降85%

昨天Claude才把AI Agent智能体的开发效率提升到10倍,原本以为已经足够强势。结果今天凌晨2点20,Claude又正式推出了一项重磅能力——The Advisor Strategy(顾问策略)。说白了,它就像一个AI版的诸葛亮。日常那些繁琐执行工作,先交给Sonnet或Haiku这类轻量模型冲在前面处理;只有碰到真正棘手的复杂问题,才请顶级的Opus在后方出谋划策。最终呈现出来的效果,居然已经接近全程使用顶级大模型的水平,但整体成本却一下子削减了85%。对于每天都在为智能体运行费用发愁的人来说,

2026-04-10 06:17:23  |  76 阅读

2026年AI发展前瞻

1. Anthropic 发布 Opus 4.5 Anthropic 的 Opus 4.5 实现重大突破,训练效率提升超过 2 倍,在多项基准测试中超越 GPT-4。2. 从生成式 AI 到代理式 AI 2026 年最重要的趋势是从生成式 AI 向代理式 AI(Agentic AI)转变,AI 系统能够自主执行复杂任务。3. 多模态大模型爆发 中国科技巨头在农历新年期间发布了一系列先进 AI 模型,支持文本、图像、语音多模态交互。4. Yann LeCun 获 10 亿美元资助 AI 先驱 Yann Le

2026-04-03 21:26:35  |  33 阅读