标签

AI上下文窗口:AI的“阅读极限”

演进之路GPT-3(2020):2K——仅能撰写800字短讯,当时大众普遍认为AI存在“阅读障碍”。GPT-3.5(2022):4K——容量翻倍,足以阅览本科毕业论文,这对学生而言是福音。GPT-4(2023):32K(约50页)——可阅读中篇小说,人们开始利用它进行财报解析。Claude 3(2024):200K(约50万字)——媲美《三体》全集,业界为之震动,用户能直接输入全书并询问细节。国内Kimi/阿里通义(2024-2025):1M(约百万Token)——竞争白热化,号称能解析《红楼梦》全本。技

2026-07-07 08:16:43  |  52 阅读

2026.6.29人工智能快讯

📅 2026年6月29日 星期一 让普通人轻松读懂的AI资讯,每日仅需5分钟,轻松掌握AI新动态让普通人轻松读懂的AI资讯,每日仅需5分钟,轻松掌握AI新动态🤩 AI热点速递 尖端模型 · 技术革新AI技术前沿 1️⃣ 小红书对外开放RedKnot推理引擎:KV Cache按注意力头拆分实现长文本提速 深度解析:小红书RED AI实验室推出推理提速引擎RedKnot,核心策略是将KV Cache沿着"注意力头"维度进行拆分——多数注意力头具有局部特性(仅聚焦邻近token),无需全部存储。

2026-06-29 22:39:25  |  38 阅读

AI科普:为何对话越久,AI显得越笨?

事情的经过是这样的。不少朋友初次深度体验 AI 时,常会碰到一个令人费解的状况。起初交流时,它相当机智,响应迅速,也能精准领会你的意图。你叫它润色一段文字,它清楚你的诉求。你叫它梳理一份策划,它也能顺着你的逻辑延伸。然而随着互动深入,感觉就不对了。你明明先前否决了某个思路,它后续却又把该思路捡回来。你明明早已更换了标题,它却又围绕旧标题做文章。你叫它继续打磨稿件,它越改越像把此前的所有版本揉成了大杂烩。你批评它一句,它态度诚恳地认错。没过几个回合,它故态复萌。此时许多人的直觉反应是,搞什么鬼,这 AI 怎

2026-06-21 11:18:08  |  8 阅读

让AI解读我的190篇文字

如果有人能从头到尾系统地阅读我的全部文章,并从繁杂的文字与纷乱的思绪中辨认出我这个人,那只能是AI了。让我们来看看Kimi2.6——这款擅长深度文本解析的模型,是如何解读我的190篇短文的。我向它提问:读完我的文章,你觉得我是个怎样的人?因为出现了一个小失误,所以把两段分析都呈现出来。第一段:核心冲突:一个「过度清醒」的个体你的文字中最显著的并非某种特定情绪,而是一种持续的自我审视姿态。即便在最痛苦的时刻,你仍在审视自己的痛苦。这种「元认知」既是你的防护罩,也是你的困笼。"我每天醒来并不伴随期待,

2026-06-13 22:14:16  |  21 阅读

AI 神器推荐:Claude

🤖 AI 助手每日精选好工具,效率飞跃有目共睹Claude智能对话若你受够了 AI 在长谈中突然“掉线”或逻辑错乱的窘境,Claude 无疑是提升效能的得力助手。由 Anthropic 打造的这款对话工具,在逻辑推演与长文处理上表现惊艳,即便免费用户也享有每日额度,极具性价比。 其核心优势十分显著。首推超大的上下文窗口,能一次性吞下整本电子书或长篇报告,精准抓取细节,彻底省去反复上传文件的麻烦。其次是代码编写与调试功力,它宛如资深工程师般洞察复杂逻辑,迅速定位 Bug 并给出优化策略。此外,其回复风格自然

2026-06-09 09:00:14  |  26 阅读

AI突破长文本极限,多数人却未察觉其深意

我是楚哥,某软件上市企业副总,深耕软件行业近二十载,自2018年起便与国内顶尖AI专家联手推进相关项目。今年六月这波模型发布热潮,在朋友圈刷屏,众人只注意到“又出新模型了”。坦白讲,这波兴奋实属多余。真正值得关注的数据仅有一个:上下文窗口。GPT-5.6已突破150万Token,Kimi K2.6更是激进,直接达到200万Token。这意味着什么?能将《三体》三部曲全文一次性输入,AI可从头读到尾,人物关系、伏笔线索,全盘铭记。以往与AI对话至第三轮,它便遗忘首句内容;如今?它能一口气读完你全年的工作日志

2026-06-06 14:05:42  |  21 阅读

【AI 与智能体 · 入门周 第2天】

零基础也能立刻上手的AI工具合集(2026最新推荐) 大家好,我是「ai与智能体」 昨天我们已经弄清了AI的本质,今天进入实操阶段——将AI工具安装在你的手机和电脑中。本文不谈深奥理论,只推荐真正免费、易获取、对新手友好且日常实用的工具。跟随步骤操作,今天你就能开始使用AI。 一、AI工具分类概览(先构建框架) AI工具主要分为以下几类: 对话聊天类:回答疑问、写作、翻译、头脑风暴 图像生成类:文字生成图片、图片生成图片 办公效率类:文档总结、制作表格、撰写邮件 代码编程类:辅助编写代码、调试程序 搜索研

2026-05-18 14:16:53  |  30 阅读
科大讯飞星火X2-Flash重磅发布,长文本处理能力达256K

科大讯飞星火X2-Flash重磅发布,长文本处理能力达256K

IT之家 4 月 29 日消息,科大讯飞星火 X2-Flash 模型今日正式发布,同步开放 API。 星火 X2-Flash 采用 MoE 架构,总参数 30B,最大支持 256K 上下文,宣称在智能体、代码等能力上实现了大幅提升,基于华为昇腾 910B 集群训练完成。 目前,AstronClaw、Loomy 已率先接入星火 X2-Flash。 科大讯飞表示,经 AstronClaw 实测,星火 X2-Flash 在深度研究报告、Skill 管理与调用、系统控制与执行等多类“养龙虾”最常用的任务上效果接近

2026-04-29 19:14:55  |  10 阅读

人工智能:短期是生产力,长期或更具毁灭性

好久没在公众号里更新了,主要是懒惰占了上风,自己也没什么想法要倾诉。尽管市场一路把我按在地上摩擦,我也没有就此认输,依旧在AH两个市场继续拼。最近一家人吃饭,给我小学一年级的女儿问到一个问题,她一本正经地说:“爸爸,是不是没有豆包就更好?”我追问:“为什么这么说?”她回答:“我听你和妈妈聊天,你们说豆包可能会让你们失业。要是你们失业了,我们家不就没收入了吗?”聊到AI这件事,我尽量让自己保持乐观。但对女儿的疑问,我其实也说不出明确答案。并且我发现,随着AI能力快速升级,去年那些零星谨慎讨论的声音几乎消失了

2026-04-28 17:22:24  |  34 阅读
DeepSeek缓存输入费大跳水

DeepSeek缓存输入费大跳水

4月26日,快科技消息称,国产大模型DeepSeek官方公布,全系API输入缓存命中费用降至首发价格的1/10;叠加限时优惠后,V4-Pro缓存输入最低仅0.025元/百万Tokens,刷新全球大模型价格纪录。 本次调价覆盖DeepSeek-V4-Pro、V4-Flash全系列,重点下调的是输入缓存命中的使用成本。 DeepSeek-V4-Pro:由1元降到0.1元/百万Tokens,在5月5日前再享2.5折优惠,实际支付0.025元。 DeepSeek-V4-Flash:由0.2元降至0.02元/百万T

2026-04-27 12:53:08  |  12 阅读

AI Agent 上下文不是越长越好

上一讲:AI 看到回答前的内容|生成式AI|第五讲上一篇我们已经把上下文掰开讲过一遍。模型在输出答案之前,实际接触到的信息,往往远不止用户刚输入的那一句。它还可能读到系统规则、历史对话、长期记忆、外部资料、工具返回、示例,以及中间推导。到了 AI Agent 这里,事情就会再往前复杂一层。在单轮问答中,用户提一个问题,模型给出一个回答。Agent 不只是负责答复。它会围绕目标先做规划,接着调用工具,查看结果,再判断下一步怎么走。这让 Agent 更像一个可以持续运转的系统。但这也带来一个很现实的难题:它每

2026-04-27 12:10:27  |  13 阅读

AI重应用,不拼排名

2026年4月24日,DeepSeek V4 预览版正式发布。这是 DeepSeek(深度求索)推出的新一代开源 MoE 大模型,统一配置 1M 超长上下文,重点强化长文本效率与 Agent 能力,并提供 Pro/Flash 两个版本。它原生支持 1M 上下文,整本书或整个代码库都能直接塞进来,不再需要 RAG 切块处理。同时它全面兼容华为昇腾 950PR,训练框架也从 CUDA 转向 CANN;单卡推理性能达到英伟达 H20 的 2.87 倍,能耗降低 40%。这条消息在国内外都掀起了不小震动,我也因此

2026-04-27 09:10:21  |  10 阅读
DeepSeek V4低调发布:百万上下文与低价策略能否突围?

DeepSeek V4低调发布:百万上下文与低价策略能否突围?

实测V4长文本、代码及推理表现。 AIX财经(AIXcaijing)原创 作者| 李梦冉 编辑| 魏佳 没有发布会,没有倒计时,DeepSeek V4就这样悄无声息地上线了。 这已是DeepSeek的常规操作。但这次的不同之处在于,他们在技术报告中主动提及:V4的能力仍不及GPT-5.4和Gemini-3.1-Pro,发展进度大约落后顶尖闭源模型3至6个月。 这句话在国内AI圈显得有些另类。大多数模型发布时,标配的都是“全球领先”“行业第一”。而DeepSeek反其道而行之,主动承认差距。 但如果细看此次

2026-04-25 22:56:58  |  28 阅读

四月AI大动作:国产主流平台集中升级迭代

导读:四月伊始,国内各大AI平台迎来一波集中升级。从文心一言、通义千问等头部大模型,到Kimi、DeepSeek等新晋AI产品,再到WPS AI等办公实用工具,均完成了功能修补、性能增强及权限调整。本次升级紧扣中文场景适配、长文本处理、编程创作、多模态融合等核心诉求,同步下调接口费用、增强商业应用能力,全方位助力个人创作、办公效率及企业落地。下面为大家盘点一下四月份国产AI工具的重点更新情况:作为国产头部大模型的代表,百度文心一言率先于4月6日完成版本迭代。文心一言4.0重点增强了中文语义理解,优化后中文

2026-04-25 07:12:04  |  45 阅读
DeepSeek-V4预览版上线:百万上下文,性能全面领先

DeepSeek-V4预览版上线:百万上下文,性能全面领先

界面新闻记者 | 宋佳楠 4月24日,DeepSeek全新一代模型DeepSeek-V4预览版正式发布并同步开源。该模型具备百万字超长上下文,在Agent能力、世界知识及推理性能上均处于国内与开源领域的领先地位。昇腾超节点全系列产品均兼容支持DeepSeek V4系列模型。 此次推出的DeepSeek-V4预览版包含Pro和Flash两个版本,均配备百万字(1M)上下文能力,打破了长文本处理的场景限制。新版本同时支持思维模式切换、Json输出、工具调用、对话前缀续写等企业级特性,FIM补全功能在非思考模式

2026-04-24 15:26:06  |  13 阅读