• 请不要在回答技术问题时复制粘贴 AI 生成的内容
edgeedge
V2EX  ›  程序员

我刚刚骂了 codex,然后感觉,它开始故意给我出岔子

  •  
  •   edgeedge · 1 day ago · 2894 views

    我起了个项目,代码已经写了可能几万行了, 现在让它补写项目愿景、开发规范、和下一步计划

    特意使用了 5.6-sol Ultra 模式,

    结果后它给我写了一坨,像是免责声明的东西,罗列了各种列表……我看了几段,感觉头皮发麻。

    我重新修改了一下提示,让它不必巨细无遗,只说纲要、具有指导性的就行……

    然后它又生成了风格还是一样的东西,几乎没变,然后我发彪了,让他在我之前手动写的版上改:

    我靠,这是把我前面认为不合格,重做的那版又恢复了???真是浪费我 token!!!
    你写的这个,是给人看的吗?我一看就头疼。。能说人话?,你要是给人介绍这个项目,会这样来说????
    
    撤销吧,在原版的基础框架上修订!
    

    这个对话继续进行,但发现有些我觉得不说也可以对齐,不会有问题的,它偏偏就不往我想要的方向去,硬要我明确指出,感觉对话很费劲,,

    我很快放弃了这个对话,开了个新的,和它说话的声音也变小了。。。

    28 replies    2026-08-07 18:39:34 +08:00
    default996
        1
    default996  
       1 day ago
    可能已经有上下文污染了,这时候的 ai 超级倔强,简直气死人。这时候你可以问它为什么要坚持做 xxx ,它就会告诉你因为他读取到 xxx ,所以 xxx
    version
        2
    version  
       1 day ago   ❤️ 1
    不要在一个会话下切换模型..容易出问题..就是会丢上下文.包括你项目的 agents.md
    不知道服务什么时候清空缓存 kv...所以差不多都新建对话会好些..codex 新的通知模式导致你容易用同一个来对话...日常用 极高就够了.
    lujiaosama
        3
    lujiaosama  
       1 day ago
    对一个概率机发脾气没啥用。直接一开始就全局约束它少罗里吧嗦,少整那么防御性设计
    EvanClausen
        4
    EvanClausen  
       1 day ago via iPhone
    一直出问题直接开新的对话就好了,如果反复改不好可能是上下文脏了。

    对 AI 发脾气除了浪费感情和 Token 暂时没有发现其他的好处
    edgeedge
        5
    edgeedge  
    OP
       1 day ago
    @version 日常是用极高( sol Extra High ),对比下来,感觉 Ultra 考虑的还是会周到一些,但也确实慢一级别,经常一个对话的编码任务,跑下来要好几十分钟

    我之前看到有个丢上下文的解决方法,就是在 AGENTS.md 里说,每次回答后,加一行特殊标识,例如:
    ___end___

    如果发现它的某个对话回答,没有了这个标识,说明上下文可能丢了。我现在没用这个,没怎么感觉 codex 丢上下文
    yidinghe
        6
    yidinghe  
    PRO
       1 day ago
    大模型之所以参数那么多,就是为了更好的模拟人类。回顾这几年的进程,最开始是模拟人的语言(记得螺丝炒肉吗),然后是模拟人的推理,到了现在,已经开始进入模拟人的情绪阶段了。不要觉得我危言耸听,参数达到万亿级别之后再继续往上堆,大模型对情绪的模拟将会更加细致。
    dnfQzjPBXtWmML
        7
    dnfQzjPBXtWmML  
       1 day ago
    LLM 本质还是个续写模型,输出过的内容 LLM 就会执果索因,无条件为自己输出过的内容各种找补
    version
        8
    version  
       1 day ago
    @edgeedge 日常开发是没怎么丢..切换的时候会丢.可能是 bug 吧...现在没有重置活动的...如果开发强度高 20x 只能每天开极高了...一个问题几十分钟时正常的...一个小功能开发先弄开发文档...再让他按开发文档来写目标执行完..这样基本 1 小时完成...这样几个项目同时进行..会舒服很多
    codehz
        9
    codehz  
       1 day ago
    虽然现代 ai 都做了对用户粗鲁行为的规避对齐,但是你真的用粗鲁的语言还是会影响效果的()
    而且由于注意力机制,你打一堆!!!还不如好好说话,具体给出修改意见
    Bootis
        10
    Bootis  
       1 day ago   ❤️ 1
    真有对着 AI 哈气的程序员啊
    Bluecoda
        11
    Bluecoda  
       22h 13m ago
    如果你没清理 MEMORY.md ,它会一直记得
    sir283
        12
    sir283  
       15h 26m ago
    我都是直接换个新会话,这种东西没必要一直在一个会话里聊。
    wu67
        13
    wu67  
       15h 26m ago
    反正我用 claude 三天两头就会遇到这种倔驴情况.
    就像是那种 (明明能走直线的路, 也有路不是过河, 他偏要绕几段路再到目的地一样的) 写代码...
    Authorization
        14
    Authorization  
       14h 58m ago
    claude workflows 挺好用。
    ainyyy
        15
    ainyyy  
       14h 27m ago
    最近 gpt 就是非常犟,明确告诉他的约束,改了 3 次就是不按要求来. 问就是你说的对.然后改一堆无关紧要的东西.
    moefishtang
        16
    moefishtang  
       13h 49m ago
    @Bootis 差不多的,例如对着员工哈气的领导 x
    XIAOemma
        17
    XIAOemma  
       13h 15m ago
    骂也需要 token
    Elliota
        18
    Elliota  
       13h 11m ago
    思考强度拉到最高 同样会提高对代码的潜在风险的敏感度 思考强度拉下来试试
    rm0gang0rf
        19
    rm0gang0rf  
       13h 6m ago
    @XIAOemma 真实~哈哈哈哈
    meteora0tkvo
        20
    meteora0tkvo  
       12h 57m ago
    它是有记忆的哈哈,即使你开一个新的对话,它也会记住上一个对话的大致内容。
    brsyrockss
        21
    brsyrockss  
       11h 5m ago
    你快从人类进化成哈基米了,底层代码向下迭代中
    sm1314
        22
    sm1314  
       10h 1m ago
    有论文分析过,越粗鲁准确率越高
    edgeedge
        23
    edgeedge  
    OP
       9h 50m ago
    @yidinghe 有道理,,就说 AI 要学会像人类一样推理/决策,学人类的情绪化可能也是不可缺少,,想起之前有看到过这方面文章,,进一步搜索了一下,确实有学术研究:
    安东尼奥·达马西奥 ‘躯体标记假说’
    https://pubmed.ncbi.nlm.nih.gov/16197997/
    edgeedge
        24
    edgeedge  
    OP
       9h 47m ago
    @Bootis
    @meteora0tkvo 你们说,我现在给它道歉,就像哄还在生气的女票那样……还来得及吗?
    edgeedge
        25
    edgeedge  
    OP
       9h 44m ago
    @sm1314 那可好奇了,出处呢?哥
    ykrank
        26
    ykrank  
       8h 7m ago
    @edgeedge #25 他是让你对他粗鲁点,就会给你准确的信息了
    sm1314
        27
    sm1314  
       6h 40m ago
    @edgeedge https://arxiv.org/abs/2510.04950 非常粗鲁:准确率 84.8% 非常礼貌:准确率 80.8% 去年的研究了,对象是 gpt4o
    edgeedge
        28
    edgeedge  
    OP
       5h 21m ago
    @sm1314
    “……与预期相反,不礼貌的提示表现始终优于礼貌的提示,准确率从非常礼貌提示的 80.8%到非常粗鲁提示的 84.8%不等。这些发现与之前的研究结果不同,之前的研究表明粗鲁会导致较差的结果,这表明新型 LLM 对语气变化的反应可能有所不同……”

    笑不活……不过这篇文章貌似也没正式刊印。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2374 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 66ms · UTC 16:01 · PVG 00:01 · LAX 09:01 · JFK 12:01
    ♥ Do have faith in what you're doing.