自回归模型不回归
怪不得 OpenAI 要推迟上市
自回归模型不回归
怪不得 OpenAI 要推迟上市
1
CodingIran 20h 6m ago 什么玩意,公司几十万行代码的项目一直都是用 Codex 开发的,从来没遇到这种问题
|
2
penzi OP @CodingIran 那你们的项目真挺简单的
|
3
nullyouraise 20h 2m ago
我改 Chromium 都是 Astra 一把梭,从来没遇到过问题,难以想象你们的项目是有多复杂
|
4
lozzow 20h 1m ago
@nullyouraise 甚至我用的 DeepSeek 4.1 flash 也能改得动
|
5
Finest 19h 58m ago
昨天才让 6.1-sol 一次改了 2000 多行代码,真不知道你的项目有多复杂
|
6
MHPSY 19h 57m ago
我自己弄了个指纹浏览器 用 claude 5.5 打 patch 改的很好
|
7
changnet 19h 56m ago
AI 基本只能在已有功能的例子上添加功能。如果没有框架限制,没有例子,尤其是需要扩展、修改原有框架实现时,现有的 AI 确实就是不行,跟代码行数没有太大关系
或者说 AI 实现得很奇怪,各种 if-else 打补丁。有些明明在基类扩展一个虚函数就很优雅,它偏不。除非不关注代码质量和后续维护,否则很难不人工修改 |
8
xing7673 19h 56m ago
降智了吧,现在黑 codex 都已经泥沙俱下了么?
|
9
cat9life 19h 53m ago
画个鹈鹕看看,大概率是降智了。
|
10
DOOMS 19h 53m ago
不知道的以为是去年发的帖子。
|
11
penzi OP |
12
Y25tIGxpdmlk 19h 52m ago 求大神让我们见识一下超高质量的项目代码(不简单的项目),学习一下。
|
13
maxwellz 19h 50m ago
可能被降智到 luna 了
|
15
CodingIran 19h 48m ago @penzi 不会接了个垃圾中转站,然后被降智后把责任怪到 codex 上了吧
|
16
Dk2014 19h 44m ago via Android
这个页面怎么跟 codex 不一样😅
o/前段时间本来就在治中转,并发多了就降智 你不会开了转发来用的吧 |
17
zeroFans 19h 41m ago 至少用上官方的 codex 再说话吧
|
18
haoooooooo 19h 40m ago
哥们,你是认真的吗?确定不是用的什么山寨 Codex ?
虽说 Astra 比不上 Opus5.5 ,但是也没不堪到这种地步。。。 |
19
alamaya 19h 37m ago
codex 需要有一个比较好的编码规范给到他才行
|
20
supersleepking 19h 37m ago
华为用户啊不奇怪了,大家喷之前可以看下这人发帖记录很有意思
|
21
icelas259 19h 37m ago
你这是掺水模型吧。先去订阅官方的 codex 看看。
|
22
mwenhua2023 19h 35m ago
5w 行都改得动
|
23
location123 19h 35m ago
deepseek 改个 500 行也是绰绰有余的吧
|
24
BanShe 19h 35m ago
xs😂
|
25
StarsunYzL 19h 34m ago 送人头 block ,但凡对当前的 AI 能力有一丁点认知+有一丁点思考能力的都会反思和反复验证自己哪里出问题了而不是下这种不过脑子的结论
|
26
strobber16 19h 29m ago
微内核
|
27
sima675 19h 28m ago
一个用中转站的就不要评论了,自己被卖了也不知道
|
28
xylxAdai 19h 24m ago
你用的什么垃圾中转站啊。500 行都改不动。你用半年前的 glm 都不至于五百行改不了。更别提 codex 了。
|
29
pengtx 19h 20m ago
懒得喷
|
30
hookbreak 19h 19m ago
你用的中转站吗
|
31
furlxy 19h 17m ago
你这个智能机器人是个什么?
中转被偷换了模型,自己不知道么? |
32
osilinka 19h 14m ago
ms build, 肯定是微软的系统,如果没有足够的 training 材料,肯定是这样啊
现在都把 AI 看的太聪明了 |
33
Satoshl 19h 14m ago
截图中转站绷不住了,自己还能发出来
|
34
Haku 19h 14m ago
@penzi #14 随机数测试只能在 GPT 内的模型进行,告诉你是否产生了 GPT 内的模型降级(例如 6.1 SOL 可能使用 luna 回复),如果你接的是中转站,给你注水成 DS 或者别的模型,随机数测试是分辨不出来的。
|
35
ishengge 19h 13m ago block, 影响我智商
|
36
laodao 19h 12m ago
你家 codex 叫智能机器人?
|
37
fkdtz 19h 12m ago
不像演的
|
38
Promtheus 19h 11m ago
|
39
keshawnvan 19h 10m ago
我用 Astra 改过最大的改动是 68 万行,其中 2 万行是业务改动,剩下都是单元测试+集成测试。
测试阶段和生产验证都是 0 BUG 。 |
40
firemiles 19h 7m ago
看到用户名 penzi ,真怀疑 up 是不是故意炒话题的
|
41
tim9527 19h 3m ago
不至于。
|
42
nutting 18h 59m ago
你这是机器人不是 codex ,更不是 ai
|
43
BRZ001 18h 56m ago
中转站 注水了兄弟,用原生 codex 吧
|
44
stardew 18h 55m ago
😅
|
45
yougg 18h 50m ago
不要回答! 不要回答! 不要回答!
这就是来骗铜币的!!! |
46
aicong2021 18h 48m ago
不太可能,500 行开源 8B 参数的模型应该都能改的动
|
47
yoyoyoyolol 18h 46m ago
你把这个问题的文本描述打出来,让大家问一下看看答案是不是和你一致,就知道是谁的问题了
|
48
d119 18h 43m ago
改是能改,就是跑不起来
|
49
seanxx 18h 41m ago
直接 block 完事,明显装糖骗回复
|
50
413420 18h 40m ago
糖 b
|
51
tcchen PRO |
52
jerseyhero 18h 30m ago
感觉像在带节奏骗回复
|
53
cropflre 18h 28m ago
怕不是中转站接的是豆包模型
|
54
hidemyname 18h 28m ago
@penzi #2 几十万行的代码挺简单???
|
55
iyaozhen 18h 15m ago
你得在 codex 里面用吧,我们之前测试过不同 harness 框架差异很大
不知道你那个什么智能机器人是怎么部署的 |
56
Kafuka578 18h 15m ago
难绷
|
57
ttkit 18h 12m ago
|
58
TofuBazinga 17h 54m ago
看到这个智能机器人绷不住了。。。
|
59
niubilewodev 17h 53m ago
哈哈,‘我写了 99 行脚本和 109 行测试。’
你用到正品 GPT 了。 |
60
Y25tIGxpdmlk 17h 50m ago
@Kafuka578 #56 你这头像倒是和难崩非常贴切。哈哈哈
|
61
Y25tIGxpdmlk 17h 49m ago
我们只是嘲讽你说 500 行代码改不动的观点,为啥就剥夺我们用 cc 的权利呢?凭啥啊?我 tm 非要用,我想用 cc 就用 cc ,想用 gpt 就用 gpt ,你管我啊?
|
62
jadeborner 17h 39m ago
这个智能机器人是什么鬼,能不能直接用官方的?
|
63
ziyanghua 17h 24m ago
你这算是那种 500 元以下没有好耳机的提问方式吗?
可以先按官方推荐的开发最佳示例开始尝试呗。 https://learn.chatgpt.com/docs/developers gpt 可能不如 claude ,但是你说的也太夸张了。 |
64
guanhui07 16h 33m ago
不太可能
|
65
fyq 16h 30m ago
区区 500 行,免费的 Claude 都能改啊……
|
66
QS0x01 16h 12m ago
唐完了
|
67
tomyark123 16h 11m ago
v2 真是遍地嘉豪
|
68
achira 16h 3m ago
确实是有差距的,就像你和正常人类一样。block
|
69
YiCheng88 15h 50m ago
deepseek 都行 你活在啥年代了
|
70
bqn 15h 26m ago
你这是什么 harness
|
71
Hilalum 15h 16m ago
gpt 和 claude 同时高强度使用十几个项目,虽然 gpt 差一点,但也差不了多少。你这不是被注水了就是 agent 的问题吧
|
72
NullIsLife PRO 有过类似的感受,一个 bug 实际上修改 10 几行代码即可. gpt 给我改了 10 几个文件上千行代码,单独的实现了一个分支功能.
opus fable 给我最大的感觉就是克制 |
73
goumadantui 15h 2m ago
500 行哈哈,我这随便十几个文件几千行上万行都是随便改,改完它自动执行用例自测,基本都是能完成功能的
|
74
Wh1t3zZ 15h 0m ago
鉴定为用中转站把脑子用坏了
|
75
jackOff 14h 54m ago
你这是不是掺水了豆包啊
|
76
hzzhzzdogee 14h 53m ago
@iyaozhen 现在 deepseek 哪个 harness 最适合呢. 各个评测/榜单, 说法都不尽相同
|
77
keethebest 14h 48m ago
笑死我了 智能机器人, 这个机器人靠谱保真吗
|
78
lemoncoconut 14h 35m ago
兄弟 币又不够用了?
|
79
deplives 14h 33m ago
|
80
94 14h 32m ago
多多少少是有点抽象的
|
81
OrangeDark 14h 31m ago
能工智人来了
|
82
cluulzz 13h 52m ago
|
83
cnevil 13h 41m ago 感觉已经塞后面了,等别人回复奖励自己
|
86
wwwwjack 13h 30m ago
看界面,有没有可能是你中转站的问题, 我反正用 gpt 经常单次改动超过 10-20 个文件, 代码都是几千行, 没出现过类似现象
|
87
Y25tIGxpdmlk 13h 25m ago
@izzzz #84 像是某个中转站的 web 对话窗口,看上去跟某些小网站的右下角智能客服窗口似的。嘻嘻
|
88
MaxJin 13h 11m ago
你这个是维护的代码吧,除非是各种代码累积出来的屎山代码,要不然连 GPT 不应该遇到这种情况。我之前遇到过用 ai 搞不定的就是屎山代码,因为内容多还在维护还要出新功能,文件关联的又多的那种会出现 ai 开始瞎写代码的情况。
|
89
Ketter 13h 1m ago
哥们连开一个官方正式的 codex 账号都不会啊?
|
90
EvaElfie 12h 49m ago
难绷,你的中转站都是掺假的你知道不?
常见的测试题测不出来的都给你路由了 |
91
mosesyou 12h 49m ago
咱能不用这些中转站了吗
|
92
i36lib 12h 49m ago
九成用的中转,掺屎了卖给你,你还以为是 codex
|
93
haidaomihuan 12h 29m ago
大概率你们项目一坨屎山、要么就是需求不明确(使用姿势不对)
|
94
lemolee 12h 26m ago
这模型现在就是一坨屎,每个任务都能搞出一个 BUG ,老子换 deepseek 了,效果都差不多,给 openai 送钱干毛
|
95
jmliang 12h 11m ago
这是 qwen 0.6b 吧
|
96
iyaozhen 11h 57m ago @hzzhzzdogee deepseek 我用得少。但肯定是适配了 Claude Code ,以及 DeepSeek 自家的。
哦哦 我们之前测试是 ChatGPT 系列,用不用 codex 差异较大 |
97
desstiony 9h 45m ago
最开始用 codex200x,切到 opus5.5 用了一周左右,被 ban 了,现在换回 codex ,难受的一批,太慢,太多防御门槛,一堆无用测试
|
98
chidiansha 9h 26m ago
至少先订阅个官方的吧哥们
|