Codex Web GPT v4.0.8 已在 macOS arm64 上完成一轮端到端测试。Browser-only 能把 ChatGPT 网页版接入 Codex 的模型选择器;Full harness 还能让模型接触文件和 Shell 工具,但会增加本地权限与账号风控压力。
v4.0.8
测试版本。
73/73
源码测试。
2 种
运行模式。
这套工具已经跑通,身份和边界仍要先确认。
本文依据一份测试与风险记录成稿。记录显示,安装 v4.0.8 启动器并登录 ChatGPT Plus。完成 Browser smoke test 和隔离 Codex 配置后,使用 chatgpt-web/high 发起真实请求。请求成功返回内容,进程退出码为 0。关键源码测试等效通过 73/73 项。
一、它把网页对话接进 Codex。
这类工具在本机启动一个代理。它通过内嵌浏览器操作 ChatGPT 网页。请求链路分为四步:Codex 发起请求。本机代理接收请求。内嵌浏览器发送消息。网页回答返回 Codex。
Codex → 本机代理 → 内嵌浏览器 → ChatGPT Temporary Chat → Codex。本机代理地址示例为 http://127.0.0.1:17841/v1。它表现得像反向代理,上游却不是 OpenAI API,而是 ChatGPT 网页。认证依赖浏览器 Cookie,网页自动化负责发送消息和读取回答。
二、Browser-only 和 Full harness 是两条使用路径。
BROWSER-ONLY
可以问答、分析代码、解释报错、审查代码和生成代码片段。不能主动读写本地文件,也不能运行命令。
FULL HARNESS
通过 MCP 把网页模型接回 Codex 工具,可读取文件、修改代码、运行测试和安装依赖。配置更复杂,权限风险也更高。
如果只是想体验网页模型,Browser-only 已经覆盖代码解释、报错分析和方案设计。需要模型直接改项目并执行测试时,才会进入 Full harness 的权限范围;这时它的行为边界与普通 Coding Agent 相近,仍应保留沙箱和人工审批。
三、安装动作影响用户级配置。
安装过程不会自动修改 Codex 项目目录,也不会向当前项目添加文件。它主要触及用户级位置:
● ~/.codex/config.toml:加入本机代理地址及兼容设置。
● ~/.codex/models_cache.json:可能清理模型缓存。
● ~/.codex-chatgpt-web:保存运行配置和浏览器状态。
● /Applications 或 ~/Applications:安装启动器。
FIX卸载前先断开路由。
卸载时应先在启动器内移除 Codex 集成或断开路由,再恢复 config.toml。直接删除 App 可能留下代理配置。
四、先用 Browser-only,再决定是否开放工具权限。
测试记录给出的上手顺序从备份开始。先备份 ~/.codex/config.toml。安装并打开启动器。在内嵌浏览器登录 ChatGPT。运行 Browser smoke test。点击安装模型。完全退出并重启 Codex。保持启动器运行。最后在模型选择器中选择 ChatGPT Web — High、Luna 或账户提供的其他档位。
这条路径把失败范围限制在模型请求和网页会话层。需要 Full harness 时,应单独确认 MCP 工具权限和项目沙箱。还要确认命令审批与依赖安装范围,避免把网页模型直接置于无审批的本地执行环境。
五、风险来自网页自动化和账号使用方式。
项目属于第三方、非官方浏览器自动化工具。它使用 ChatGPT 浏览器登录状态,并非 OpenAI API。自动创建 Temporary Chat、发送大段 Codex 上下文、连续或并发运行任务,都可能提高账号异常检测或限制的可能性。自动操作网页和推理档位,以及使用 Bigger Context,也会增加网页请求次数。
项目讨论区出现过一名用户声称使用后账号受到限制。这是单方面报告,无法单独证明因果关系;它至少说明账号风险存在用户侧反馈,不能在使用前承诺账号安全。
按这份测试记录,偶尔少量使用 Browser-only 属于中等风险。长期作为主力 Coding Agent 属于中高风险。高并发、长时间运行或 Bigger Context 属于高风险。多账户轮换或规避额度属于极高风险,不建议采用。
使用边界。 如果 ChatGPT 主账号承载重要工作,请优先选择官方路径。可选路径包括 Codex 官方 ChatGPT 登录、OpenAI API 或官方支持的自动化认证方式。第三方网页桥接可以用于短期体验,不能作为重要生产工作的唯一入口。
SOURCES
主要依据 — 用户提供的《codex-chatgpt-web 测试与风险问答》。
来源边界 — 版本、测试结果、风险分层和账号限制案例均按该测试记录归属,未在本文中升级为官方承诺。