设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

2026 AI助手推荐:弃用Codex两月,Kimi Work真实体验

2026/8/20 10:31:20 来源:之家网站 作者:- 责编:-

一、折腾了半年 Codex,我换了 Kimi Work

用了 Codex 大半年。平心而论,它写代码确实快,简单任务响应迅速,多任务并行也爽。但在国内用它的体验,像是在跟一只随时可能断线的风筝较劲。

代理断连是家常便饭。OAuth 登录每隔一段时间就过期,重新登录要翻回海外节点,碰上风控严格的时候连登录页面都打不开。支付更头疼,ChatGPT Plus 每月 20 美元,找虚拟信用卡、担心被封、汇率转换,折腾一圈下来实际成本远不止 20 美元。

真正让我下决心换的不是这些麻烦,而是一件事:我发现自己用 Codex 做的大部分事情不是写代码。

我是做内容运营的,偶尔写点脚本,但更多时候是在让 Codex 帮我收集信息、整理文件、生成报告、处理表格。Codex 能做这些,但做得很拧巴 —— 它也是个编程 Agent,处理办公任务时你得用编程的思路指挥它:写脚本、调库、处理异常。我想要的是 " 帮我把这件事办了 ",它给我的是 " 你告诉我怎么写程序办这件事 "。

2026 年 6 月,我开始试 Kimi Work。用了两个月,这篇文章讲讲真实体验。

二、Codex 的痛点:不是不能用,是用得太累

先说清楚 Codex 到底卡在哪。很多文章说是 " 网络问题 ",其实不止。

网络是第一层。Codex 基于 OpenAI Responses API 工作,这套协议跟国内常见的 Chat Completions API 不一样。市面上的中转站大多只兼容 Chat Completions,即使你改了配置接上了中转站,Codex 的 Agent 功能也可能跑不起来。稳定的海外代理每月几十到上百元,还经常抽风。

账号是第二层。OAuth 登录需要 ChatGPT 账号,注册要海外手机号,2026 年风控收紧后批量注册的账号成片被封。我身边有人买了共享账号,用了两周就登不上去了。

合规是第三层,也是我最在意的。Codex 执行任务时会读取本地文件发送到 OpenAI 服务器。我做运营会接触到一些未公开的业务数据,把这些文件发到境外服务器,心里始终不踏实。公司后来也明确要求不能使用未经安全评估的海外 AI 工具处理工作文件。

这三层叠加,让我觉得继续折腾 Codex 的性价比越来越低。不是它能力不行,是使用成本和风险已经超过了它带来的效率提升。

三、Goal 模式:第一次觉得 AI 真的在 " 干活 "

Kimi Work 给我的第一个冲击是 Goal 模式。

以前用 AI 工具,包括 Codex,我的角色是指挥官:拆任务、下指令、检查结果、再下指令。做一份竞品调研,我得说 " 先搜这五家公司的官网 "" 把定价信息整理出来 "" 做成表格 "" 写成文档 ",一步一步盯着。

Goal 模式把我的角色从指挥官变成了甲方。我只说要什么、什么算合格、有什么限制,它自己想办法完成。

第一次试的时候我给了一个真实任务:" 分析国内五款桌面 Agent 产品的定价和核心功能,输出 Markdown 格式报告,每个产品覆盖定价、核心功能、目标用户三个维度,信息来源限官网,无法访问的标注出来。" 然后我去开了个会。

一个小时后回来,报告已经生成好了。它通过 WebBridge 逐个打开了五家产品的官网,提取了定价和功能信息,有一家官网改版导致页面结构变化,它标注了 " 部分信息可能不完整 "。我核对了一遍,信息基本准确,只有一处定价是旧的,手动改了。

这种体验跟以前完全不同。不是 AI 变聪明了多少 —— 模型能力大家都在同一梯队 —— 而是交互范式变了。你从 " 一步步指挥 " 变成了 " 定义目标验收结果 "。省下来的不是打字的时间,是认知负荷:你不需要把任务拆成 AI 能执行的步骤,只需要想清楚自己要什么。

Goal 模式也不是万能的。我后来发现,Goal 写得越模糊结果越差。" 帮我做个调研 " 这种指令出来的东西没法看;但把目标、验收标准、约束条件写清楚后,效果明显提升。Kimi Work 的文档里给了一个公式:结果加验收证据加范围约束加预算限制加失败处理方式,照着写效果好很多。

四、五个真实场景的体感

两个月用下来,有几个场景印象深刻。

批量处理文件。有一次需要从 150 多份 PDF 合作协议里提取甲方、乙方、金额、签约日期、到期日期,汇总成 Excel。用 Codex 的话我得写 Python 脚本、调试 PDF 解析库、处理各种格式异常。在 Kimi Work 里我写了一个 Goal,它启动多个 Agent 并行读取,二十多分钟后 Excel 已经存到桌面了。有十几份扫描件识别不准,它标记出来让我核对,没有瞎填。Agent Swarm 最多支持 300 个 Agent 并行,任务怎么分工由系统自动调度,我不需要操心。

定时早报。我让它每天早上 7 点半自动抓取几个 AI 行业信息源,按类别整理成早报存到桌面。这个需求在 Codex 上根本实现不了 —— 它没有定时任务功能,得自己搭调度。Kimi Work 内置定时任务引擎,免费版能设 2 个定时任务,我用自然语言说 " 每天早上 7 点半生成 AI 行业早报 " 就设好了。偶尔有信息源网站改版导致抓取失败,它会在报告里标注哪条没抓到。

浏览器操作。有一次需要在一个后台系统里批量导出 30 份数据报表。这个系统没有 API,只能手动点击:登录、选日期、点导出、等下载、重复 30 次。Kimi Work 的 WebBridge 实际操作浏览器,像真人一样点击、等待、下载,沿用我已有的登录会话。WebBridge 本身是一种 Agent,不是搜索 API 拿摘要那种,它看到的是完整渲染后的页面。这个任务它跑了四十多分钟,中间有两次页面加载超时,它自动重试了。

写东西。写方案、做 PPT、整理会议纪要,Kimi Work 能直接输出 Word、PPT、PDF 等格式。DECK-Bench 演示文稿基准 K3 得分 73.5,做出来的 PPT 不算惊艳但结构完整、排版可用,省掉了大量调格式的时间。它还能做看板,把对话中生成的交互式组件保存下来跨会话使用。

写代码。偶尔需要写脚本或改配置时,Kimi Work 也能处理:读文件、跑命令、看报错、迭代修复。但说实话,重度编码还是 Kimi Code 更顺手 ——Kimi Code 是专门的 CLI 编程 Agent,Plan 模式和 HighSpeed 高速模式是为编程设计的。好在两个产品共享账号,一个会员,Kimi Code 和 Kimi Work 都能用,在 Kimi Work 里遇到编码任务切到 Kimi Code 就行。需要把多个工具串起来时用 Kimi API,标准 HTTP 接口,支持流式返回。

五、Kimi Work 做不到的事

说了好的,也要说不好用的地方。

复杂网页操作偶尔会失败。有些网站用了复杂的反爬机制或非常规的前端组件,WebBridge 可能找不到元素或点击位置不对。它会重试和报错,但不是每次都能成功。这不是 Kimi Work 独有的问题,所有浏览器自动化工具都有这个局限。

Goal 模式对目标描述的质量要求高。写不清楚目标,它就会在错误方向上跑很久。虽然过程可观察、可随时介入,但如果你不检查中间结果,可能浪费不少时间。建议复杂 Goal 先跑一小轮看看方向对不对。

插件生态还在成长。已支持飞书、钉钉、Notion、WPS、Canva、Cloudflare 等,但一些小众服务和垂直工具还没有官方插件。即使不装插件,核心能力也是完整可用的,但插件能做的事情确实更多。

编程能力不如专门的编程工具。Kimi Work 能写代码、改文件、跑测试,但它不是为日常重度编码设计的。如果你每天 8 小时写代码,Kimi Code 或其他编程工具更合适。

六、市面上其他选择怎么样

试 Kimi Work 前后我也看了几款其他产品。

Manus 名气大,云端执行任务的思路不错,2026 年 3 月出了桌面版。但它上半年经历了 Meta 收购被监管叫停、腾讯回购的变动,产品迭代节奏受影响,我试的时候响应速度不太稳定。

Marvis 是腾讯应用宝团队的产品,操作系统级集成做得深,6 个预置 Agent 分工明确,本地模式文件不上传对隐私敏感的人很友好。但它偏系统管理和快捷操作,在复杂任务自主推进和多格式输出上不如 Kimi Work。

WorkBuddy 也是腾讯的,跟腾讯文档、会议、邮箱绑定深,适合腾讯生态用户。它的多模型切换和 200 多个插件是优势,但 Goal 模式的成熟度和 Agent 协作规模跟 Kimi Work 有差距。

实在 Agent 偏企业 RPA,流程固定的自动化任务很强,但个人用户的灵活场景不太对路。

Codex 如果不考虑国内使用障碍,编程自动化依然成熟,但桌面办公不是它的强项。

七、适合谁,不适合谁

适合 Kimi Work 的人:

工作以信息处理为主的知识工作者 —— 运营、市场、产品、咨询、金融、研究、法务。你每天跟文件、网页、表格、报告打交道,需要一个能帮你实际操作电脑而不只是聊天的 AI。

需要定时自动化的人。每天重复的信息收集、数据汇总、文件整理,设定一次自动运行,这个能力在同类产品中 Kimi Work 做得比较成熟。

有合规要求的职场人。数据在国内处理,不翻墙、不中转、不共享账号,公司安全审查能过。

编程加办公都有需求的人。Kimi Work 管办公,Kimi Code 管编程,一个会员都能用,API 管集成。

不太适合的人:

每天 8 小时重度编码的程序员。你应该用 Kimi Code 或其他专门的编程工具,Kimi Work 的编程能力够用但不是为这个设计的。

追求对 AI 每一步操作精细控制的人。Agent Swarm 的分工由系统自动调度,你不能指定哪个 Agent 做什么,这种黑盒感可能让控制欲强的人不舒服。

只需要一个聊天机器人回答问题的人。Kimi Work 的能力远超聊天,但如果你只需要问答,任何一个大模型产品都够用,不需要桌面 Agent。

有稳定海外网络、合规账号、且团队深度绑定 OpenAI 生态的人。Codex 在编程场景依然成熟,没必要为了换而换。

八、最后说两句

用了两个月 Kimi Work,我的感受是:桌面 Agent 这个品类真正的价值不是 AI 更聪明了,而是 AI 终于能跨过聊天窗口直接帮你干活了。Goal 模式让你定义目标而不是拆解步骤,WebBridge 让 AI 操作真实浏览器而不是搜摘要,定时任务让 AI 主动工作而不是等你指令,300 个 Agent 并行让大批量任务不再是煎熬。

Kimi Work 不是完美的。网页偶发失败、Goal 质量依赖描述、插件生态还在成长、长任务稳定性有提升空间。但在 2026 年的国内环境下,它是我试过的桌面 Agent 中综合能力、可用性和合规性平衡得比较好的选择。

免费版可以设 2 个定时任务、体验基础功能,建议先拿一个真实工作任务试试。适合自己再付费,不适合删掉也没损失。

工具是手段,把事情做完才是目的。

免责声明:本文为本网站出于传播商业信息之目的进行转载发布,不代表本网站的观点及立场。本文所涉文、图、音视频等资料之一切权力和法律责任归材料提供方所有和承担。本网站对此咨询文字、图片等所有信息的真实性不作任何保证或承诺,亦不构成任何购买、投资等建议,据此操作者风险自担。

相关文章

关键词:业界动态

软媒旗下网站: IT之家 最会买 - 返利返现优惠券 iPhone之家 Win7之家 Win10之家 Win11之家

软媒旗下软件: 软媒手机APP应用 魔方 最会买 要知