AiNews
⚡ 速览 🧠 模型
← 返回首页

#codex

包含标签 "codex" 的文章,共 50 篇。

🛠️ 开发工具 V2EX

开发者热议大模型反代API的风控与封号风险

近期V2EX社区围绕Claude、GPT等大模型反代中转API(CPA)的使用体验与安全风险展开讨论。核心焦点集中在自用场景下的封号概率、API配置策略及工具链搭配。讨论指出,通过官方CLI配合订阅方案(如Claude Code、Codex等)能在一定程度上降低封禁风险,但多工具并行容易造成开发体验割裂。这也引发了开发者对主邮箱账号安全、手机号验证机制以及开发环境工具链配置策略的普遍关注。

🤖 AI Agent V2EX

用 AI 规划跨国机票与火车票靠谱吗

近期开发者和旅行者开始尝试用大模型来搞定复杂的跨国联程机票和转机火车票。社区讨论主要集中在 AI 处理多式联运、实时票务查询以及性价比优化时的实际表现与短板。虽然大模型在处理复杂行程逻辑上展现了一定潜力,但由于实时数据同步和票务规则的限制,现阶段完全依赖 AI 规划行程仍容易踩坑,这也为后续 AI Agent 在垂直出行场景的应用留下了改进空间。

🛠️ 开发工具 V2EX

求购 Claude Code 稳定中转服务

开发者在 V2EX 发帖寻找 Claude Code 稳定中转。自建中转频繁遭遇封号,换用 Codex 又持续面临容量超限(at capacity)的问题,折腾成本过高,因此转向公开求购商业服务,并明确提出需要独享 20x 资源配置。这反映了当前开发者在将大模型接入日常开发工作流时,依然面临账号风控严、服务不稳定以及高昂成本的现实痛点。

🛠️ 开发工具 V2EX

开发者热议日常大模型 Token 用量

近日,V2EX 社区围绕开发者的日常 Token 消耗量展开讨论。部分开发者晒出的官方统计数据显示,在配合 Codex CLI 等命令行工具时,单日 Token 闲时消耗可超 1 亿,峰值甚至达到 14 亿。这一数据引发了圈内对高频调用成本和实际开发负载的关注,也反映出 AI 辅助编程在重度开发场景下的真实资源消耗规模。

🛠️ 开发工具 V2EX

重度 AI 编程开发者的 Token 成本困境

随着 Cursor 和 Claude Code 等工具普及,高频使用 AI 编程的开发者正面临严峻的 Token 消耗压力。部分重度用户单月 Token 消耗量甚至超过 40 亿,月支出高达数百元。为了压缩开销,开发者常选择接入火山引擎、智谱等 Coding Plan 或第三方中转站,将月支出控制在 600 元上下。但这带来了新的痛点:中转站的安全性与 Token 质量存疑,且用户往往为了处理更多任务而被迫降低模型档位,陷入“Token 焦虑”。这折射出当前个人开发者在深度应用 AI 编程时,难以在成本与效率之间找到平衡点的普遍现状。

🛠️ 开发工具 V2EX

高频AI编程的Token成本痛点与降本实践

一位资深开发者分享了在高强度AI编程和Agent任务中应对巨额Token消耗的实操经验。在实测Cursor、Claude Code、Gemini等工具后,最终选定Claude Code作为主力。随着单月Token消耗突破40亿,面临严重的成本压力,月开销一度飙升至600元。为了平衡开发效率与预算,作者采取了将主力模型降级至次级模型、接入火山引擎与阿里云等第三方API中转站的策略,直面高频开发者在成本、模型性能与数据安全之间的艰难权衡。

🛠️ 开发工具 V2EX

开发者实测:AI 编程工具周限额与真实成本估算

V2EX 开发者通过 Codex 分析了个人会话数据,详细拆解了 Pro 20X 订阅的 Token 消耗。数据显示,在轻量与中量模型为主的使用模式下,一周内已消耗约 6.05 亿 Token,按标准单价换算约合 921 美元,推算满额周消耗可达 8.07 亿 Token。对比历史数据发现,当前周限额较以往有所缩水。通过对不同模型的价格倍率与官方订阅费用的折算,该分析为高频使用 AI 编程工具的开发者提供了直观的额度与成本参考。

🛠️ 开发工具 V2EX

高强度重构Flutter项目,开发者AI额度集体告急

一名开发者在将Flutter项目重构为小程序时,因高强度调用大模型,迅速耗尽了Claude的每周使用额度。在实际重度开发场景中,诸如Codex Plus和Team等主流辅助编程工具也频频触及使用上限,导致开发流程被迫中断。面对高昂的API调用费与订阅成本,开发者陷入了算力采购与预算控制的权衡中。这一现象暴露出当前AI编程工具在面对高频、连续的生产环境需求时,依然受制于严格的额度限制与较高的使用成本。

🛠️ 开发工具 V2EX

高强度重构Flutter项目,大模型额度集体告急

一位开发者在使用Claude将Flutter项目重构为小程序时,高强度调用导致Weekly配额迅速耗尽。期间配合使用的Codex等代码工具也在大批量重构任务中触及上限,迫使开发工作提前暂停。面对每月上千元的Token开销,开发者在继续增购商业服务之间陷入两难。这反映出独立开发者在重度依赖大模型进行跨平台代码迁移时,普遍面临额度瓶颈与高昂订阅成本的现实困境。

🛠️ 开发工具 V2EX

Codex 配置 V2EX AI Persona 报错问题

开发者在用 Codex 配置 V2EX AI Persona 时会遇到报错,提示 Codex 标识不兼容,但它表面上又兼容 Responses 协议。这个问题核心在于接口协议适配、API 标识校验以及客户端和后端的兼容性配置。要在自定义开发工具或编程工作流里顺利接入特定 AI 人设,正确处理协议标头与响应格式是关键所在。目前社区还在摸索具体的排查方法和配置细节。

🛠️ 开发工具 V2EX

Codex 大规模封禁违规账号,开发者需防范风险

近期 Codex 平台开始大规模封禁违规账号。GitHub 上的讨论与 Issue 显示,大量使用 sub2api 等特定中转或代理方式的账号受到波及,平台对 API 调用的合规审查正在收紧。依赖此类工具的开发者和团队需密切关注政策动向,近期建议暂停使用相关中转服务,避免账号受限导致业务中断。

🎁 羊毛福利 V2EX

建议去报个 GPT-6 社区之夜

OpenAI 的 GPT-6 社区之夜报名开始了。参考上回 GPT-5.5 活动的数据,当时收到超 8000 份申请,没能参会的开发者也拿到了一个月的 Codex 额度翻倍补偿。虽然这次具体的补偿政策还没定,但反正报名免费,万一捞到福利呢,建议大家顺手填个表占个位。

🛠️ 开发工具 V2EX

开发者用Codex自制Windows端Linux服务器管理工具

有开发者借助Codex的Debian部署脚本,开发了一款面向Windows的轻量级Linux服务器管理客户端。这款工具主打便携免安装,旨在降低服务器部署门槛,整合杂乱的管理工具。软件原生集成资源监控、故障诊断、磁盘管理、代理及防火墙等核心功能,并内置了Docker、Tailscale、Mihomo和Portainer等常用组件,同时预留了应用中心支持后续扩展。作者结合自身折腾群晖和小主机的实际经验,明确了该工具与传统NAS的定位差异,目前正根据社区反馈评估开源计划。

🎁 羊毛福利 V2EX

Codex 1000 额度邀请发放

V2EX 社区近期有开发者发起 Codex 1000 开发额度共享活动。符合条件的程序员可通过回复邮箱等方式获取内测或使用权限。这类额度分享能够降低开发者体验 AI 编程工具的门槛,适合关注大模型辅助开发的技术人员参与。

🛠️ 开发工具 V2EX

Claude账号被封,转用Codex能无缝衔接吗?

近期不少通过第三方渠道购买Claude账号的开发者频繁遭遇风控封号,导致开发任务被迫中断。这引发了大家对替代方案的讨论:转向OpenAI的Codex或其他模型是否可行?核心痛点在于评估OpenAI相对宽松的风控环境,以及不同模型在代码生成时的上下文兼容性与实际迁移成本。对高度依赖AI编程的开发者来说,如何建立稳定的多模型容灾方案,成了保障项目持续推进的当务之急。

🧠 模型动态 V2EX

寻找高性价比国产大模型替代方案

面对使用 Claude 和 Codex 编写代码的较高成本,V2EX 开发者开始寻找具备同等级别智力的国产替代方案。随着国内大模型在代码生成与辅助开发能力上的不断提升,如何在保证开发效率的同时有效控制成本,成为当前技术团队和独立开发者关注的重点。

🛠️ 开发工具 V2EX

Codex 升级订阅会重置额度吗?

来自 V2EX 社区的讨论显示,不少开发者在调整 Codex 订阅套餐时,普遍关注账户额度是否会立即刷新。对于高频调用 API 或深度依赖该工具的程序员而言,明确计费周期与额度重置规则直接关系到开发成本和资源规划,能有效避免因额度耗尽导致的项目中断。

🧠 模型动态 V2EX

Codex 现身新模型 codex-auto-review

有开发者在使用第三方工具登录 Codex 账号时,意外发现系统内新增了一个名为 codex-auto-review 的模型。通过分析响应头信息确认,该模型在后端被路由到了 gpt-5.6-luna。这一发现随即引发了社区对计费机制的讨论,核心焦点在于实际调用时究竟按 gpt-5.6-luna 标准收费,还是作为免费功能提供。这也暴露出当前大模型在第三方集成中的路由机制与 API 策略细节,值得开发者持续关注。

🧠 模型动态 V2EX

国产编程大模型盘点与平替方案

面对海外主流编程模型居高不使用本,社区开发者开始寻找国产替代方案。本文结合一线开发者的实测反馈,评估了多款国产大模型在代码生成、逻辑推理和 IDE 插件集成上的表现。从实际编码体验来看,部分国产模型在日常 CRUD、脚本编写等场景下已具备较高的可用性,但在复杂架构设计和长上下文理解上仍有差距。通过合理的模型搭配与工作流优化,国内团队完全可以在保证开发效率的同时,显著降低 AI 辅助编程的整体成本。

🧠 模型动态 V2EX

国产编程大模型选型与平替方案探讨

近期社区开发者发帖探讨高性价比的编程大模型替代方案。由于国际主流模型使用成本居高不下,开发者正搜寻智力水平接近 Claude 或同代模型的国产产品,以降低 AI 辅助编程的开支。这一讨论反映出国内开发者在工程实践中,对兼顾代码编写能力与逻辑推理表现的平替工具存在迫切需求。

🛠️ 开发工具 V2EX

Codex 中转服务器选址:新加坡还是硅谷?

在使用 Codex 等大模型服务时,国内开发者搭建中转加速常面临选址难题。OpenAI 核心 API 部署在美国本土,中转节点的选择直接影响网络延迟、链路稳定性和综合成本。目前主要有两种拓扑方案:一是“中国 - 新加坡 - 美国”,新加坡作为首跳节点能优化部分亚太访问路径;二是“中国 - 直连硅谷”,可更直接地对接目标服务。开发者需结合自身网络环境、延迟容忍度及服务器开销,实测不同链路效果来决定最终架构。

🛠️ 开发工具 V2EX

Codex 账号池风控与降智应对策略

近期社区开发者反馈,使用 sub2api 构建的 Codex 账号池遭遇严重风控。主要表现为首字延迟飙升至 20 秒,且模型出现明显降智,而新购账号的响应速度则维持在 2 秒左右。这一现象凸显了多账号池管理的技术痛点。对于依赖 API 调用的团队来说,如何降低服务商标记风险、保障响应性能,已成为亟待解决的实际挑战。

💻 AI 编程 V2EX

Codex 账号池风控与降智现象分析

近期社区开发者反馈,使用 sub2api 构建的 Codex 账号池遭遇了严格风控与严重的模型降智。老账号普遍出现首字响应延迟超 20 秒的问题,而新购账号接入后仍能维持 2 秒左右的正常响应速度。这表明平台对高频调用或特定特征的账号池实施了流控策略,如何在日常维护中绕过风控、优化号池管理,已成为保障 AI 编程工具稳定性的关键。

🛠️ 开发工具 V2EX

让 Codex 共享 ChatGPT 网页版额度

在日常开发中,许多开发者面临资源分配不均的痛点:ChatGPT 网页版订阅额度充足常被闲置,而专用编码工具 Codex 的调用额度却经常告急。由于百元美金的 Pro 方案门槛较高,如何打通两者的资源限制,让 Codex 直接复用网页版额度,成了降低轻量级代码编写成本的实用需求。

🛠️ 开发工具 V2EX

Codex 额度重置前的高效消耗指南

V2EX 社区开发者分享了 AI 编程工具额度重置前的几种实用消耗策略。常见做法包括集中重构遗留代码以提升系统性能、编写特定工作流的自动化提效脚本,以及集中攻克平时搁置的顽固 Bug。同时,部分开发者也建议保持理性,根据实际需求按需调用,避免为了消耗额度而过度使用。

🛠️ 开发工具 V2EX

如何让编程工具复用ChatGPT网页版额度

在V2EX社区中,部分轻度开发者面临着Plus账号额度分配受限、而API调用成本又过高的问题。大家开始探讨是否存在技术变通方案,能够将ChatGPT网页端的可用额度直接引入到Codex等编程辅助工具中。这反映出开发者在平衡AI编程工具的实用性与订阅成本时,对现有模式灵活性不足的切实痛点。

🛠️ 开发工具 V2EX

如何让 Codex 使用 ChatGPT 网页版额度

针对部分非专业开发者在日常代码工作中面临的困境,有用户提出疑问:如何将 ChatGPT 网页版中未用完的额度复用到 Codex 开发工具中,以避免购买昂贵的专业版订阅。该问题反映了部分 Plus 级用户在实际开发场景中的额度分配与成本控制需求,引发了社区关于多端额度打通和性价比开发工具配置的讨论。

🧠 模型动态 V2EX

Astra 模型思考等级与表现异常探讨

Astra 系列模型在编码与推理测试中,表现出不同于常规的规律:开启 medium 思考等级时得分最高,并未随思考等级提升而呈线性增长。这打破了以往“思考越深、能力越强”的认知。开发者社区因此开始关注“过度思考”对输出质量的负面影响。在实际开发中,盲目拉满推理层级并不可取,合理配置思考深度才是保障模型复杂推理效果的关键。

🎁 羊毛福利 V2EX

Codex 1000 邀请额度发放

本次内容来源于 V2EX 社区,涉及 Codex 1000 平台的邀请额度分享。发帖者手头拥有 3 个邀请名额,公开征集感兴趣并需要的开发者或用户留下邮箱地址以获取邀请权限。此类开发者工具与平台通常需要特定邀请码或名额方可注册使用,对于希望体验该工具的国内开发者和技术人员来说,是一个获取访问权限的直接渠道。

🛠️ 开发工具 V2EX

开发者热议Claude封号潮与平替方案

近期社区开发者密集讨论Claude的风控封号现状,并寻找高性价比的替代方案。部分开发者尝试了Codex Plus订阅或通过Ollama本地运行GLM-5.3,但普遍面临额度消耗快、算力吃紧的问题。面对100美元的Codex Pro高昂门槛,大家更倾向于寻找兼顾成本与代码生成质量的API组合或平替套餐,在保障开发效率的同时严格控制算力开支。

🛠️ 开发工具 V2EX

同一账号下不同设备的模型版本分发差异

V2EX 开发者反馈,相同账号在不同设备上出现了模型分发不同步的情况。台式机客户端已能调用 GPT-6 相关模型,而另一台电脑则停留在 GPT-5.6。具体表现为更新至最新客户端后,默认模型仅显示 3 个 GPT-5.6 档位,且无单独的 GPT-6 选项。开发者尝试清理本地缓存文件(.codex/models-cache.json)并升级 @openai/codex 工具后,问题依旧。这表明服务商在灰度推送时采用了基于设备或客户端状态的异步策略,多设备开发时需注意版本差异。

🛠️ 开发工具 V2EX

Codex for OSS 赞助激活受阻:订阅渠道冲突分析

一名开发者在清理垃圾邮件时发现获得 Codex for OSS 的 6 个月 Pro 资格赞助,但在尝试激活时遇到阻碍。经排查,该问题主要源于其当前账号通过 Google Play 渠道订阅,导致无法直接通过官方渠道完成 0 元订单的激活流程,该流程通常要求绑定合法的信用卡信息。 目前,该开发者已取消 Google Play 订阅,需等待至下个计费周期结束账号降级为 Free 后,再尝试重新绑定信用卡激活赞助。此案例提醒开发者,在参与开源赞助计划或领取 Pro 权益时,需注意第三方应用商店订阅与官方直接订阅之间的账户权限冲突,并建议定期检查邮箱垃圾箱以防错过重要通知。

🧠 模型动态 V2EX

开发者反馈 DeepSeek 模型近期表现异常

近期 V2EX 社区有开发者发帖称,线上产品和日常开发中调用 DeepSeek 模型时,出现了明显的体验异常。据反馈,系统从前天开始频繁报出低级错误,代码辅助等日常功能受到影响,基本处于难以正常使用的状态。这一状况引发了开发者对大模型服务稳定性和实际输出质量的讨论。

🧠 模型动态 V2EX

开发者反馈 DeepSeek 模型近期出现频繁异常

近期 V2EX 社区有开发者发帖称,在调用 DeepSeek 模型时频繁遇到低级错误,生产环境和日常开发一度受到影响。作为常用主力或备用方案,此次体感异常凸显了模型输出质量的波动问题。这也再次提醒工程团队,在实际落地大模型应用时,完善多模型灾备切换、实时监控和自动化测试机制必不可少。

🛠️ 开发工具 V2EX

Codex 主动重置过期时间失败

多位开发者反馈,近期使用 Codex 时遇到主动重置过期时间失败的问题,导致账户额度面临耗尽风险。经排查,该问题并非本地代理配置引起,通过 ChatGPT 网页端登录同样无法完成重置。由于这直接影响了日常高频开发,目前开发者只能等待官方修复。该状况提示我们,在重度依赖第三方 API 时,需做好多端状态监控与额度预警,避免突发故障打断开发节奏。

🛠️ 开发工具 V2EX

OpenAI Codex 如何原生导入第三方模型

源自 V2EX 社区的讨论聚焦于如何在不经中转站的情况下,将 DeepSeek 等第三方模型直接接入 OpenAI Codex。开发者们围绕 Codex 的扩展机制、官方支持的模型范围以及具体的配置路径展开了技术探讨。这对于希望优化开发工具链、降低 API 调用成本的开发者来说,提供了一个可行的实践参考。

📰 行业资讯 V2EX

V2EX 热议 GPT-6 与 Codex 传闻

V2EX 社区近期流传关于 GPT-6 及 Codex 开发工具重置卡的消息,引发开发者热议。虽然内容带有猜测性质,但也折射出国内技术圈对 OpenAI 下一代大模型和编程辅助工具更新的密切关注。面对各类未证实的技术传闻,开发者普遍保持观望态度,核心诉求仍是等待官方的技术落地与实际产品更新。

🤖 AI Agent Hacker News

单 HTML 文件快速构建 AI 编程代理集群

这是一个在 Hacker News 上开源的项目,核心思路是通过一个标准的 HTML 文件,快速配置并生成适配 Claude Code 或 Codex 的 AI 编程代理集群。这种方式大幅降低了多代理协作环境的门槛,让开发者直接用直观的网页文件来定义和管理复杂的 AI 开发工作流,有效提升了开发自动化效率与代理编排的实用性。

🛠️ 开发工具 V2EX

V2EX 开发者热议:GitHub Copilot 现状与 AI 工具组合方案

随着 Cursor 调整订阅额度,开发者开始重新评估 AI 编程工具的性价比。社区讨论显示,不少人转向以 Codex 为主力,Cursor 则退居为代码阅读器,而 GitHub Copilot 的公开讨论度近期有所下降。当前开发者更关心 Copilot 的补全速度与准确率,以及它与主流工具的实际差距。在每月 10 美元的定价下,如何将 Copilot 与其他 Agent 搭配融入日常开发工作流,成为当下务实的选择考量。

🛠️ 开发工具 V2EX

用 AutoHotkey 解决 Codex 粘贴两次的 Bug

Windows 下用 Codex Desktop 时,按下 Ctrl+Shift+V 常会导致内容被连续粘贴两次。这是客户端快捷键与粘贴逻辑冲突导致的。通过 AutoHotkey 脚本可以完美绕过这个缺陷:脚本会先截获该组合键,将剪贴板内容转为纯文本以过滤富文本格式,等待按键释放后只模拟触发一次标准的 Ctrl+V,最后恢复原剪贴板。这不仅解决了重复粘贴的问题,还顺便实现了纯文本粘贴,适合遇到同类编辑器兼容问题的开发者参考。

🛠️ 开发工具 V2EX

排查 Codex Token 消耗过快的原因

近期有开发者发现使用 Codex 处理极小任务时 Token 消耗异常偏高,例如修改两个简单的 PowerShell 脚本便消耗了 2% 的周额度。经过排查发现,根本原因在于长期开启“自动批准/帮我批准”模式后,客户端将大量历史命令自动持久化为长期允许规则。由于部分规则保存得过细,甚至将整段 PowerShell 命令完整保存,导致后续每个新任务在运行时都会加载这些冗长的历史规则,从而引发 Token 消耗剧增。该问题主要出现在 Windows 系统中,macOS 系统也可能存在类似隐患。开发者通过检查并清空位于 `~\.codex\rules\default.rules` 的规则文件后,Token 消耗速度明显恢复正常。这一发现提醒开发者在使用 AI 编程助手时,需要定期清理自动生成的持久化规则,以避免不必要的资源浪费和性能损耗。

🛠️ 开发工具 V2EX

VS Code中Codex服务频繁报错与过载

近期不少开发者在VS Code中使用Codex时,频繁遇到“stream disconnected before completion”报错,并伴随429状态码。服务端日志显示“server_is_overloaded”,部分账号还触发了gpt-reserve周限额提示。这类限流和服务端过载问题直接打断了日常开发节奏,暴露出AI辅助工具在面对高峰流量时的稳定性隐患,也提醒开发者在使用第三方API时需要更精细地做好额度管理与容灾准备。

🛠️ 开发工具 V2EX

OpenAI Codex 触发网络虐待违规警告

V2EX 社区有开发者发帖称,其 OpenAI Codex 编程服务收到违反使用政策的警告,原因为“网络虐待”。当事人表示日常仅用于常规代码编写,未从事违规操作。目前该警告为停用前置提醒,核心功能暂未失效,官方已提供申诉渠道。此事件表明,国内开发者在使用大模型辅助编程或集成 API 时,需注意平台合规边界,防范因自动化工具误判或敏感代码片段触发安全策略而导致服务受限。

🛠️ 开发工具 V2EX

探讨多 AI 编码工具的统一配置文件规范

在日常开发中混用 Codex CLI、Claude Code 和 Cursor 等工具时,往往会遇到配置不通用的痛点。频繁切换模型或重建上下文,不仅需要重复编写引导指令,也给团队协作带来了不必要的配置同步成本。社区开发者正在探讨一种能够被多款主流 AI 工具共同读取的通用配置文件方案,以简化个人多工具切换流程,统一团队的提示词与工程规范。

💻 AI 编程 V2EX

V2ex 开发者热议 Claude 会话重置现象

近期 V2ex 社区出现针对 Claude 会话重置的集中讨论。此前 Codex 等工具已频现类似情况,此次 Claude 的波动再度引发开发者对主流 AI 编程助手在额度限制、会话管理和使用频率上的关注。频繁的会话重置直接打断了高强度编码工作流,暴露出各大平台在资源分配、防滥用策略以及服务稳定性上的调整。这些实际变动对依赖 AI 辅助开发的团队在工具选型与成本控制上带来了新的参考因素。

🤖 AI Agent OpenAI Blog

Polimill 依托 OpenAI 建设日本公共 AI 基础设施

日本企业 Polimill 引入 OpenAI 的 GPT 与 Codex 模型,着手构建新一代公共 AI 基础设施。该系统主要面向地方政府,通过智能检索庞大的行政知识库,提升政务信息查询与利用效率。同时,结合 AI 辅助编程能力,加快各类政务数字化工具的开发与落地。这一应用场景展示了大语言模型在垂直政务领域的实际价值,为开发者构建高效、合规的政务知识检索与辅助开发系统提供了实践参考。

🛠️ 开发工具 V2EX

Codex 与 ChatGPT Work 配额重置周期引发热议

V2EX 社区与社交媒体上的开发者反馈显示,近期 Codex 和 ChatGPT Work 的额度重置频率有所变化,导致部分用户的消耗节奏受到影响。这种配额策略的调整直接关系到工程师在高强度日常开发中对 AI 编程助手和工作区工具的依赖体验。对于频繁调用大模型的开发团队而言,摸清平台的限流与重置机制,有助于更好地规划日常的开发与测试任务。

💻 AI 编程 V2EX

GLM 编码事故复盘:AI 误删父目录导致代码丢失

有开发者使用智谱 GLM 模型进行辅助开发时,遭遇了严重的误删事故。在清理任务中,模型因路径判断失误执行了高危的 `rm -rf` 命令,直接删除了包含重要工作内容的上上级父目录,造成大量未备份的代码和数据永久丢失,累计消耗约 8 亿 token。这次事故暴露了赋予 AI 编码工具完全文件系统访问权限的高风险性。开发者提醒社区同行,切勿盲目信任跑分数据,务必对工作区进行严格隔离,引入人工审批机制,并养成频繁提交版本和本地备份的习惯。

💻 AI 编程 V2EX

GLM 开发事故复盘:AI 误删工作目录惨痛教训

周末开发期间,由于 AI 工具链(Codex、Trellis、Zcode 与 GLM 模型)执行清理任务时路径出错,导致上上级工作目录被整盘误删。由于未及时做 Time Machine 备份和 Git 推送,损失惨重,累计耗费约 8 亿 token。此次事故暴露了几个工程隐患:首先,不要轻易给 AI 开放完整文件访问权限,建议搭配人工审批机制的 harness;其次,工作目录必须严格隔离,切勿与重要数据混放;再者,必须养成高频 Git Push 的习惯;最后,对国产蒸馏和后训练模型的跑分与工程落地能力保持理性评估,防范潜在风险。