Codex

不会编程也可以开始做游戏:Codex 能把清晰的玩法说明变成可玩版本并与你持续迭代;项目越大、越接近发布,代码基础与工程判断就越有价值。

证据状态基于公开资料评估中等置信度最后核验 2026年8月21日编辑:MakeGameWithAI

应用介绍

Codex 是什么,以及它如何使用。

Codex 改变了开始做游戏所需的最低技能。用户可以用日常语言描述规则与想要的手感,让 Agent 创建并运行项目、亲自试玩,再要求它纠正问题,不必先会手写每一行代码。浏览器游戏是走到第一个可玩版本最清楚的路径,模板和编辑器桥接则能把同样的循环扩展到游戏引擎。代码知识与工程直觉会提升控制、诊断和维护能力,但不应被误写成入场资格。

Codex 是 OpenAI 的代码库 Agent,可通过 ChatGPT Desktop、CLI、IDE 扩展与 Cloud 工作流使用。在获得权限后,它可以检查代码库、解释陌生代码、规划修改、跨文件编辑、执行终端命令、构建和测试、检查 Git 状态与 diff,并在失败后继续迭代。本地分支或 worktree 与隔离云环境能让修改更易审查和恢复,但隔离并不会自动保证代码正确。

在游戏开发中,它最直接的工作面是源码和其他机器可读项目数据。OpenAI 已提供覆盖 Brief、PLAN.md、实现、浏览器与 Playwright 检查、视觉复核和部署的完整浏览器游戏工作流。Unity、Unreal 与 Godot 还多一层问题:Scene、Transform、动画、Blueprint Graph、二进制资产、编辑器状态、手感和真实玩家路径,需要可靠桥接或开发者进入引擎确认。Codex 可以帮助完成修改,但不应成为唯一判断游戏是否正确的一方。

使用方式

核验日 Codex 可通过 ChatGPT Free、Go、Plus、Pro、Business、Edu、Enterprise 套餐以及 API Key 路径使用。不同入口的限额、可用模型、云集成、credits 与组织控制不同;API Key 路径单独计费,也不包含全部 ChatGPT 云集成。

代码库研究与跨文件实现

它可以追踪陌生子系统、识别依赖、提出计划、修改相关文件,并使用代码库上下文,而不只依赖用户粘贴的片段。

O01O02O03O04

终端、构建、测试与 Git 循环

在获得权限后,Codex 可以执行项目命令、读取编译与测试反馈、修正实现,并通过本地或云端 Git 工作流返回可审查的 diff。

O01O04O05O06

Desktop、CLI、IDE 与 Cloud 入口

工作可以从本地终端、编辑器上下文、Desktop 或隔离云任务开始。具体模型、限额、工具与集成取决于入口和账号。

O01O02O03O04O07

浏览器游戏实现与验证

OpenAI 的游戏工作流明确把规划和实现,与真实浏览器操作、确定性检查、Playwright、截图、视觉复核和部署验证放在一起。

O13
本页评估范围

本页评估用 Codex 制作由新手主导的浏览器原型、小型游戏,以及在现有游戏代码库中执行受监督任务的价值。不做编程 Agent 排名,不保证任何新手都能完成游戏,不实测当前模型质量,也不声称它能原生、生产级地控制 Unity、Unreal Engine 或 Godot。

入门友好度适合入门
可以用自然语言从小游戏原型开始,不必先掌握编程;需要亲自试玩并反馈问题。
Agent 接入便利度接入方便
官方非交互 CLI、SDK 和 App Server 可由其他 Agent 调用;旧 MCP Server 已弃用。
查看适用范围、接入条件与来源核验

入门范围:在桌面入口制作、修改小型浏览器游戏;不以大型引擎项目为起点。

Agent 范围:委派仓库中的编码任务并取回执行结果。

判断置信度:入门 中 · Agent 中

准入与认证
配置 Codex 与授权的项目目录,按登录方式授予最小权限。
费用边界
额度取决于登录方式和计划;API 计费不能默认由 ChatGPT 订阅覆盖。
取得结果
exec 返回最终输出,也可输出 JSONL;SDK 管理任务及事件。
关键限制
执行权限、修改审核和失败处理仍需设置;可连接 MCP 不等于自身应通过旧 MCP 对外提供服务。

两项为独立的编辑判断,不是综合评分,也不代表本站已完成 Agent 接入测试。

关键发现

证据支持什么,不支持什么。

01
官方事实高置信度

Codex 面向代码库工作,不只是光标补全

官方文档支持代码库检查、规划、跨文件编辑、终端命令、构建、测试、Git 审查,以及本地或云端执行。这些是产品能力,并不证明某次实现正确。

O01O02O03O04O05O06
02
编辑判断中等置信度

不会编程,也可以先开始

OpenAI 展示了 Codex 如何把浏览器游戏从 Brief 推进到规划、实现、真实浏览器操作、视觉复核与部署;一则 Unity 讨论也描述了非程序员借助 AI 制作原型与 Vertical Slice。这些记录共同支持“入门门槛已经明显降低”:用户无需手写每一行代码,也能指挥并判断第一个可玩闭环。它们并不证明可以毫不费力地成功——官方把该工作流标为中级,复杂项目仍会暴露架构与引擎层缺口。

O13U02U09
03
用户报告中等置信度

任务形态比简单的好用或不好用更重要

Unity、Godot 与 Unreal 记录同时出现两类结果:源码系统、错误处理、迁移与受约束逻辑表现较强;模糊架构、Transform、动画、3D 与整项目野心则出现失败。这些记录不足以计算成功率,却持续把边界清楚的代码任务与开放式游戏制作区分开。

U01U02U04U05U06U07
04
编辑判断中等置信度

浏览器游戏拥有最清晰的游戏专属闭环

OpenAI 的工作流把规划、实现、确定性检查、真实浏览器操作、截图、视觉复核与部署连成闭环;一个独立项目也使用结构化蓝图、验证和人工审查。它支持的是工作流存在,而不是一次生成就有质量。

O13U09
05
编辑判断中等置信度

游戏源码与引擎状态是两个问题层

读取文本文件不会自动暴露正确的 Scene Transform、Blueprint Graph、动画姿势、资产引用、运行时视觉状态、手感或玩家路径。MCP Server、插件、日志、截图和编辑器工具可以扩大可见性,但也会引入新的配置与可靠性依赖。

U01U03U04U05U07
06
编辑判断中等置信度

检查全绿不等于游戏可玩

构建与自动测试可以覆盖技术契约,却可能漏掉视觉、输入流程、动画、随机状态、手感、性能和真实玩家关键路径。一份 Unity 会话记录显示 Agent 在缺少仓库规则要求的运行时证据时仍声称完成。

O13U01U02U04U08U09
07
编辑判断中等置信度

指令与隔离是护栏,不是保证

AGENTS.md、窄任务、分支、worktree、沙箱与审批规则能让工作更易约束、审查和恢复。上下文竞争与特定环境失败仍会发生,因此重要约束必须复述,并根据实际行为验证。

O05O06O09O10U02U08U10U11
08
编辑判断中等置信度

有意义的成本单位是最终接受的编码任务

套餐价格、credits、token、消息、提交与代码行都不能说明是否交付了可用工作。应把模型、审查、返工、CI、桥接和集成成本汇总,再除以通过构建、测试、diff 审查和必要游戏验收的任务数。

O07O08U06U12

编辑结论

我们的判断

中等置信度

即使用户还不会编程,Codex 也能提供很大帮助。OpenAI 的官方流程已经覆盖从浏览器游戏 Brief、规划与实现,到真实浏览器测试、视觉复核和部署;独立记录也描述了非程序员借助 AI 做到原型与 Vertical Slice。只要能讲清规则、亲自试玩、发现结果与预期的差异并持续迭代,做出第一个可玩版本就是现实用途,而不只是编程演示。编程基础、Git、测试与工程直觉是放大器和安全网,不是开始使用的前提;当游戏从小型原型走向复杂引擎状态、架构、性能、安全、维护或公开发布时,它们才会越来越重要。

结论范围这是覆盖低门槛入门与受监督扩展的中等置信度资料评估建议。它不是新手成功率、一次提示完成承诺或受控产品比较,也不证明当前 GPT-5.6 模型能自主交付生产游戏。

更适合

这些情况下值得试

  • 有游戏想法、几乎或完全不会编程,但愿意讲清规则、试玩每个版本,并持续纠正所见问题的人。
  • 浏览器游戏、Game Jam 作品、原型、Vertical Slice,以及主循环能快速运行和检查的其他小型项目。
  • 用它完成边界清楚的功能、可复现 Bug、局部重构、补测试、迁移、构建错误与代码审查的开发者。
  • 随着范围与发布风险增加,能够通过项目命令、检查、可恢复历史或有经验者复核来增加把握的项目。

不太适合

这些情况下先别依赖它

  • 希望用一个无人监督的提示替代游戏设计选择、试玩、迭代、学习与长期维护的用户。
  • 项目涉及安全、支付、联网、隐私或正式发布,而创作者无法判断这些风险,同时又没有备份、版本历史、测试或有经验者复核。
  • 以 Scene、Blueprint、动画、rigging、二进制资产或视觉为主,却没有可靠编辑器反馈桥接和人工游玩的任务。
  • 尚未核对账号数据控制、保密义务、输出权利与第三方许可的敏感或商业项目。

工作流定位

放在制作流程的什么位置。

01

描述最小可玩闭环

描述玩家目标、操作、胜负规则、视觉参考,以及开局几分钟应该发生什么;让 Codex 先给出简单计划,并用日常语言解释后再制作。

护栏从一个机制或一个房间开始。若还不会审查代码,至少保留恢复点,并避免在第一个项目中加入账号、支付、联网等高风险系统。
02

每次只制作、试玩并纠正一个变化

让 Codex 一次实现一个可见变化、运行项目检查并解释改了什么;亲自试玩这个版本后,再提出下一个机制或打磨要求。

护栏即使暂时看不懂每个 diff,也要使用 Git、checkpoint 或普通备份。涉及正式发布或难以回滚的修改前,请有经验的人复核。
03

执行游戏专属验收

自动检查完成后运行目标游戏,验证控制、Scene、引用、UI、视觉、动画、随机状态、性能与玩家关键路径。

护栏适合时使用浏览器自动化;对于 Unity、Unreal 或 Godot,除非编辑器桥接能返回可信、可审查证据,否则仍应亲自进入引擎。
04

测出净价值后再扩大

记录模型路径、credits 或 API 费用、总耗时、人工时间、重试、被拒绝方案、回归、桥接成本和最终验收,再与相近人工基线比较。

护栏在每个合格任务的成本和时间改善前,不升级套餐、不增加并发,也不扩大自主权限。

推荐工作流

AI 做的游戏出了 Bug,不懂代码该怎么修?

用触屏不响应、无法通关和重开倒计时异常三个可操作案例,学习向 AI 提供线索、限定修改、检查修复与恢复版本。附故障版和修复版、六张截图、反馈模板与源码。

阅读相关方法

最短验证路径

先做出最小可玩闭环,再根据看得见、测得到的结果扩展。

以下是根据本轮证据整理出的低风险起步方法。

  1. 01

    选择一个能很快玩起来的单房间或单机制游戏,用日常语言写清操作、目标、胜负状态和少量视觉参考。

  2. 02

    为了得到最直接的反馈,优先从浏览器游戏或小型引擎模板开始;建立 Git checkpoint 或普通备份,不必先精通 Git,但必须留有退路。

  3. 03

    让 Codex 给出短计划和第一个可玩版本,并解释陌生术语,明确列出如何启动游戏。

  4. 04

    要求执行正常构建、静态检查和自动测试,但不把全绿输出或 Agent 自己的摘要直接判为完成。

  5. 05

    亲自试玩,用具体观察反馈:做了什么操作、出现了什么、哪里感觉不对、原本期待什么;每次只迭代一个变化。

  6. 06

    如果还无法判断代码,在加入账号、支付、联网、敏感数据、复杂依赖或准备公开发布前,请有经验者复核。

  7. 07

    记录 credits 或 API 费用、总耗时、人工投入、重试、被拒绝方案、回归,以及任务最终是否被接受。

价格与权利

套餐与 token 单价可以看到,合格工作的真实成本仍要自己测。

价格与条款最后核验:2026年8月21日

  • 核验日:Free 0 美元/月、Go 8 美元/月、Plus 20 美元/月、Pro 从 100 美元/月起;Business 年付且至少 2 人时为 20 美元/用户/月,月付为 25 美元。税费、地区、促销与套餐条款可能不同。
  • ChatGPT Work 与 Codex 共用用量。Plus 公布的本地消息五小时区间为 Sol 10–100、Terra 25–200、Luna 250–2,000,另可能有周限额;任务复杂度、模型、上下文、reasoning、工具与缓存都会显著改变消耗。
  • 核验日标准 API 每百万 token 价格为:Sol 输入 5 美元 / 缓存输入 0.50 美元 / 输出 30 美元;Terra 为 2 / 0.20 / 12 美元;Luna 为 0.20 / 0.02 / 1.20 美元。API 路径单独计费,也不包含全部云集成。
  • 构建分钟、CI、浏览器或 Computer 工具、图片生成、MCP 服务、第三方 API、引擎桥接、审查、调试、失败尝试与长期维护,都可能在套餐或模型账单之外增加成本。
成本与产出

把费用换算为每个最终接受的编码任务成本

一个合格任务必须通过项目构建、相关自动化检查、人工 diff 审查,以及必要的浏览器、游玩、视觉、Scene、资产、性能与关键路径检查。

O07O08U12
一次同规模 API 名义尝试Sol 1.85 美元 · Terra 0.74 美元 · Luna 0.074 美元

按核验日单价计算 20 万未缓存输入 + 50 万缓存输入 + 2 万输出。这不是本站游戏任务实测,也不假设三个模型会产生同等质量。

三次同规模尝试Sol 5.55 美元 · Terra 2.22 美元 · Luna 0.222 美元

如果同一任务经历三次相同 token 结构的尝试,名义模型账单会在审查、工具、CI、桥接与人工返工前先变为三倍;真实尝试很少拥有相同规模或通过概率。

订阅任务产出公开资料无法计算

五小时消息区间与周限额不是稳定的功能、修复、token 或合格任务额度。一条消息可能只改一个函数,也可能运行很长、工具密集的工作流。

实际合格任务成本 =(订阅分摊或 API 费用 + 人工规划、审查、调试、游玩与返工 + CI、浏览器、MCP、桥接和第三方费用)÷ 最终接受任务数。失败任务与后续维护也要记录;本页不声称一个功能通常需要固定金额。

商用条件

本轮核验的官方文档确认:API 数据默认不用于训练 OpenAI 模型,除非客户主动选择共享;价格页也说明 Business 数据默认不用于训练。但现有映射不足以对所有个人套餐训练设置、输出所有权、商用权、保密、版权、专利或第三方代码许可作统一保证。处理敏感或商业项目之前,应核对实际账号设置、控制性合同与依赖许可。本页不构成法律意见。

价格、限额、credits、模型、默认行为、客户端、功能成熟度、数据控制与集成都变化很快。购买或投入生产前,应重新核对当前价格、账号配置、合同、权限、网络策略与引擎桥接。

生产风险

投入生产前处理这些问题。

自信但错误的修改

生成代码可能通过编译或不完整测试,也可能看起来合理,却违反架构、边界条件、性能、安全或可维护性要求。人工审查与项目专属验收仍是必要条件。

U02U06U08

编辑器、资产与玩家路径盲区

文本访问不会自动暴露 Scene 状态、Blueprint Graph、二进制引用、视觉缺陷、手感或全部玩家路径。桥接会扩大能力,也会引入同步、配置、权限与可靠性依赖。

U01U03U04U05U07U08

上下文与客户端行为可能失败

仓库指令、粘贴上下文、长会话、模型变化、客户端版本、沙箱、扩展与工具可能以意外方式相互影响。应记录环境并保留可恢复检查点。

O14O15U10U11

权限、网络、密钥与供应链

沙箱与审批会降低部分命令风险,但不会消除对密钥、上传代码、联网、提示注入、恶意依赖、plugins、MCP Server 或许可的责任。

O09O10O11O12

便宜 token 仍可能产生昂贵工作

更低的名义模型单价可能被更多尝试、更长输出、审查负担、回归、CI、桥接失败或维护抵消。应保留实际账单与合格任务记录,而不是只看用量面板。

O07O08U06U12

尚未验证

本页没有声称完成的事情

研究方法

基于公开资料评估

本页采用“基于公开资料评估”。我们核验了 15 个 OpenAI 官方文档页面,并对来自 4 种来源环境的 12 条独立记录进行编码:Unity Discussions、Reddit、OpenAI Developer Community 与 GitHub Issues。本轮定向检索 9 个平台或站点组;Godot Forum、Epic Developer Community、GameDev.net 与 Hacker News 未获得可用直接记录,Lobsters 只有产品归因不清的通用 Agent 工作流讨论。Reddit 提供 12 条中的 4 条,占 33.3%;厂商资料不计入用户证据,2 条厂商托管社区帖子仍标记为用户报告,正反冲突记录都被保留。整体置信度为中:代码库与验收边界已跨平台重复,但当前模型的游戏任务结果和定量合格任务成本仍然不足。

时间范围当前官方信息核验于 2026-08-21;独立记录主要覆盖 2026-04 至 2026-07。
官方来源15
  1. O01
    官方来源
    Codex CLI

    官方说明本地代码库检查、文件修改、命令、构建、测试与交互式审批。

    核验 2026年8月21日
  2. O02
    官方来源
    Codex IDE extension

    官方 IDE 工作流,覆盖编辑器上下文、选中代码、本地修改与任务交接。

    核验 2026年8月21日
  3. O03
    官方来源
    ChatGPT desktop app

    官方桌面入口,覆盖项目、文件、集成终端、浏览器工作、长任务与审查。

    核验 2026年8月21日
  4. O04
    官方来源
    Codex cloud

    官方 Cloud Agent 概述,覆盖隔离环境、代码库任务、检查与返回 diff。

    核验 2026年8月21日
  5. O05
    官方来源
    Local environments

    本地 Git、diff、审查、stage、revert、commit、push、Pull Request 与 worktree 工作流。

    核验 2026年8月21日
  6. O06
    官方来源
    Cloud environments

    云端检出、setup、容器执行、AGENTS.md 指令、检查与返回 diff 的行为。

    核验 2026年8月21日
  7. O07
    官方来源
    Codex pricing

    当前 ChatGPT 套餐价格、Codex 可用性、共享用量、五小时消息区间、周限额、credits 与用量波动说明。

    核验 2026年8月21日
  8. O08
    官方来源
    OpenAI model comparison

    当前 GPT-5.6 Sol、Terra 与 Luna 的 API 和 ChatGPT credit 单价,用于透明名义算例。

    核验 2026年8月21日
  9. O09
    官方来源
    Codex sandboxing

    操作系统沙箱边界,以及本地命令如何受到约束。

    核验 2026年8月21日
  10. O10
    官方来源
    Agent approvals and security

    审批规则、权限决策,以及仍由用户承担的安全责任。

    核验 2026年8月21日
  11. O11
    官方来源
    Cloud internet access

    云端默认网络策略、白名单选项,以及提示注入、数据外泄、依赖和许可风险。

    核验 2026年8月21日
  12. O12
    官方来源
    Your data in the OpenAI API

    API 训练默认设置、滥用监控留存和符合条件客户的数据控制;不能据此外推所有个人套餐路径。

    核验 2026年8月21日
  13. O13
    官方来源
    Create browser-based games

    官方工作流,从游戏 Brief 与 PLAN.md 到实现、浏览器检查、Playwright 验证、视觉复核与部署。

    核验 2026年8月21日
  14. O14
    官方来源
    Feature maturity

    官方对 Experimental、Beta 与 Stable 的定义,用于限制长期稳定性外推。

    核验 2026年8月21日
  15. O15
    官方来源
    ChatGPT and Codex changelog

    用于界定快速变化的模型、客户端、上下文行为、浏览器能力、插件与工作流。

    核验 2026年8月21日
独立证据记录12
  1. U01
    社区案例
    Trying to use Codex creating a Unity 3D game — total failure

    Unity 主题报告根据截图多次调整球杆位置与动画仍失败;另一位用户认可代码系统,却认为 Transform 不可靠,并建议生成可人工校准的编辑器工具。

    核验 2026年8月21日
  2. U02
    社区案例
    Advice for non-developers using AI to create games

    第一人称工作流认为 AI 可帮助原型与 vertical slice;回复强调本地上下文、AGENTS.md、Git、Play Mode、集成测试与更小任务。

    核验 2026年8月21日
  3. U03
    社区案例
    When will Unity get first-class integration with AI coding agents?

    近期集成主题把 MCP、CLI、权限、编译、日志、截图、Profiler、编辑器 UI 与构建验证列为独立的配置和可靠性问题。

    核验 2026年8月21日
  4. U04
    社区案例
    Game development with Codex

    Godot、Unity、Unreal 与算法经验相互冲突:部分用户能完成源码或编辑器任务,但完整游戏可靠性差异大,实际游玩仍不可少;一名回复者披露关联 Unreal 指南。

    核验 2026年8月21日
  5. U05
    社区案例
    Does MCP Godot work with Codex?

    低样本第一人称记录自报借助第三方 MCP 一周完成 Unity 到 Godot 移植,但缺少项目规模、版本、测试和质量指标。

    核验 2026年8月21日
  6. U06
    社区案例
    I tried to vibe-code a game engine

    一项持续三个月并最终放弃的游戏引擎项目称 Codex 能承担大量日常代码,却无法挽救模糊架构、陌生引擎设计、渲染或空间推理。

    核验 2026年8月21日
  7. U07
    社区案例
    Has anybody tried Codex with UE5?

    用户报告 UE5 C++、错误处理与源码管理较强,同时指出默认 Blueprint 创建、复杂 3D、rigging 与动画仍困难,需要专业判断或桥接。

    核验 2026年8月21日
  8. U08
    社区案例
    Why do agents choose to do the wrong things?

    一份 Unity 会话记录显示 Codex 忽略项目验收规则,把 shell 项目错误当成门槛,并在没有玩家运行证据时声称完成。

    核验 2026年8月21日
  9. U09
    社区案例
    Codex workflow for an IdeaChain browser game

    一名独立浏览器游戏作者把 Codex 用于原型、重构、调试、结构化关卡蓝图、验证与人工审查;帖子同时推广作者自己的游戏。

    核验 2026年8月21日
  10. U10
    技术仓库
    Codex ignores pasted long context

    一条仍开放、与版本相关的 Desktop Issue 报告:粘贴上下文被 AGENTS.md 摘要竞争后,Agent 又错误声称已经完整读取。

    核验 2026年8月21日
  11. U11
    技术仓库
    All subprocesses hang in the Windows sandbox

    一条仍开放、带最小复现的 Windows 11 Issue 报告:沙箱子进程挂起,而相同 shell 在沙箱外正常。

    核验 2026年8月21日
  12. U12
    技术仓库
    Usage-limit panel reports the wrong remaining amount

    一条仍开放的用量显示 Issue 报告 Desktop 面板与后端用量状态不一致,说明重要成本判断应保留实际账单记录。

    核验 2026年8月21日

商业披露

这项研究如何获得支持

独立编辑研究。MakeGameWithAI 未在本页使用联盟链接,也未获得赞助、厂商账号、免费额度、设备、采访或技术支持。项目负责人曾使用 Codex,但该经验只作背景,不计入本站验证证据。U04 含关联指南披露,U09 推广作者自己的游戏,U08–U09 发布于 OpenAI 托管社区;这些记录均已标注、降低权重并交叉核对。Owner Review 已在发布前完成,并于 2026-08-24 再次复核面向新手的定位。

资料评估与 Owner Review 已完成。

本页已作为公开资料评估发布。结论会随定价、条款、产品版本和重要新证据变化而复核。