自回归模型不回归
怪不得 OpenAI 要推迟上市
自回归模型不回归
怪不得 OpenAI 要推迟上市
1
CodingIran 9h 47m ago 什么玩意,公司几十万行代码的项目一直都是用 Codex 开发的,从来没遇到这种问题
|
2
penzi OP @CodingIran 那你们的项目真挺简单的
|
3
nullyouraise 9h 44m ago
我改 Chromium 都是 Astra 一把梭,从来没遇到过问题,难以想象你们的项目是有多复杂
|
4
lozzow 9h 42m ago
@nullyouraise 甚至我用的 DeepSeek 4.1 flash 也能改得动
|
5
Finest 9h 39m ago
昨天才让 6.1-sol 一次改了 2000 多行代码,真不知道你的项目有多复杂
|
6
MHPSY 9h 39m ago
我自己弄了个指纹浏览器 用 claude 5.5 打 patch 改的很好
|
7
changnet 9h 37m ago
AI 基本只能在已有功能的例子上添加功能。如果没有框架限制,没有例子,尤其是需要扩展、修改原有框架实现时,现有的 AI 确实就是不行,跟代码行数没有太大关系
或者说 AI 实现得很奇怪,各种 if-else 打补丁。有些明明在基类扩展一个虚函数就很优雅,它偏不。除非不关注代码质量和后续维护,否则很难不人工修改 |
8
xing7673 9h 37m ago
降智了吧,现在黑 codex 都已经泥沙俱下了么?
|
9
cat9life 9h 34m ago
画个鹈鹕看看,大概率是降智了。
|
10
DOOMS 9h 34m ago
不知道的以为是去年发的帖子。
|
11
penzi OP |
12
Y25tIGxpdmlk 9h 33m ago 求大神让我们见识一下超高质量的项目代码(不简单的项目),学习一下。
|
13
maxwellz 9h 31m ago
可能被降智到 luna 了
|
15
CodingIran 9h 29m ago @penzi 不会接了个垃圾中转站,然后被降智后把责任怪到 codex 上了吧
|
16
Dk2014 9h 25m ago via Android
这个页面怎么跟 codex 不一样😅
o/前段时间本来就在治中转,并发多了就降智 你不会开了转发来用的吧 |
17
zeroFans 9h 22m ago 至少用上官方的 codex 再说话吧
|
18
haoooooooo 9h 22m ago
哥们,你是认真的吗?确定不是用的什么山寨 Codex ?
虽说 Astra 比不上 Opus5.5 ,但是也没不堪到这种地步。。。 |
19
alamaya 9h 18m ago
codex 需要有一个比较好的编码规范给到他才行
|
20
supersleepking 9h 18m ago
华为用户啊不奇怪了,大家喷之前可以看下这人发帖记录很有意思
|
21
icelas259 9h 18m ago
你这是掺水模型吧。先去订阅官方的 codex 看看。
|
22
mwenhua2023 9h 16m ago
5w 行都改得动
|
23
location123 9h 16m ago
deepseek 改个 500 行也是绰绰有余的吧
|
24
BanShe 9h 16m ago
xs😂
|
25
StarsunYzL 9h 15m ago 送人头 block ,但凡对当前的 AI 能力有一丁点认知+有一丁点思考能力的都会反思和反复验证自己哪里出问题了而不是下这种不过脑子的结论
|
26
strobber16 9h 10m ago
微内核
|
27
sima675 9h 10m ago
一个用中转站的就不要评论了,自己被卖了也不知道
|
28
xylxAdai 9h 5m ago
你用的什么垃圾中转站啊。500 行都改不动。你用半年前的 glm 都不至于五百行改不了。更别提 codex 了。
|
29
pengtx 9h 1m ago
懒得喷
|
30
hookbreak 9h 1m ago
你用的中转站吗
|
31
furlxy 8h 58m ago
你这个智能机器人是个什么?
中转被偷换了模型,自己不知道么? |
32
osilinka 8h 56m ago
ms build, 肯定是微软的系统,如果没有足够的 training 材料,肯定是这样啊
现在都把 AI 看的太聪明了 |
33
Satoshl 8h 55m ago
截图中转站绷不住了,自己还能发出来
|
34
Haku 8h 55m ago
@penzi #14 随机数测试只能在 GPT 内的模型进行,告诉你是否产生了 GPT 内的模型降级(例如 6.1 SOL 可能使用 luna 回复),如果你接的是中转站,给你注水成 DS 或者别的模型,随机数测试是分辨不出来的。
|
35
ishengge 8h 54m ago block, 影响我智商
|
36
laodao 8h 53m ago
你家 codex 叫智能机器人?
|
37
fkdtz 8h 53m ago
不像演的
|
38
Promtheus 8h 52m ago
|
39
keshawnvan 8h 51m ago
我用 Astra 改过最大的改动是 68 万行,其中 2 万行是业务改动,剩下都是单元测试+集成测试。
测试阶段和生产验证都是 0 BUG 。 |
40
firemiles 8h 48m ago
看到用户名 penzi ,真怀疑 up 是不是故意炒话题的
|
41
tim9527 8h 44m ago
不至于。
|
42
nutting 8h 40m ago
你这是机器人不是 codex ,更不是 ai
|
43
BRZ001 8h 37m ago
中转站 注水了兄弟,用原生 codex 吧
|
44
stardew 8h 36m ago
😅
|
45
yougg 8h 31m ago
不要回答! 不要回答! 不要回答!
这就是来骗铜币的!!! |
46
aicong2021 8h 29m ago
不太可能,500 行开源 8B 参数的模型应该都能改的动
|
47
yoyoyoyolol 8h 28m ago
你把这个问题的文本描述打出来,让大家问一下看看答案是不是和你一致,就知道是谁的问题了
|
48
d119 8h 24m ago
改是能改,就是跑不起来
|
49
seanxx 8h 22m ago
直接 block 完事,明显装糖骗回复
|
50
413420 8h 21m ago
糖 b
|
51
tcchen PRO |
52
jerseyhero 8h 11m ago
感觉像在带节奏骗回复
|
53
cropflre 8h 9m ago
怕不是中转站接的是豆包模型
|
54
hidemyname 8h 9m ago
@penzi #2 几十万行的代码挺简单???
|
55
iyaozhen 7h 56m ago
你得在 codex 里面用吧,我们之前测试过不同 harness 框架差异很大
不知道你那个什么智能机器人是怎么部署的 |
56
Kafuka578 7h 56m ago
难绷
|
57
ttkit 7h 53m ago
|
58
TofuBazinga 7h 35m ago
看到这个智能机器人绷不住了。。。
|
59
niubilewodev 7h 34m ago
哈哈,‘我写了 99 行脚本和 109 行测试。’
你用到正品 GPT 了。 |
60
Y25tIGxpdmlk 7h 32m ago
@Kafuka578 #56 你这头像倒是和难崩非常贴切。哈哈哈
|
61
Y25tIGxpdmlk 7h 30m ago
我们只是嘲讽你说 500 行代码改不动的观点,为啥就剥夺我们用 cc 的权利呢?凭啥啊?我 tm 非要用,我想用 cc 就用 cc ,想用 gpt 就用 gpt ,你管我啊?
|
62
jadeborner 7h 20m ago
这个智能机器人是什么鬼,能不能直接用官方的?
|
63
ziyanghua 7h 5m ago
你这算是那种 500 元以下没有好耳机的提问方式吗?
可以先按官方推荐的开发最佳示例开始尝试呗。 https://learn.chatgpt.com/docs/developers gpt 可能不如 claude ,但是你说的也太夸张了。 |
64
guanhui07 6h 14m ago
不太可能
|
65
fyq 6h 12m ago
区区 500 行,免费的 Claude 都能改啊……
|
66
QS0x01 5h 53m ago
唐完了
|
67
tomyark123 5h 52m ago
v2 真是遍地嘉豪
|
68
achira 5h 44m ago
确实是有差距的,就像你和正常人类一样。block
|
69
YiCheng88 5h 31m ago
deepseek 都行 你活在啥年代了
|
70
bqn 5h 7m ago
你这是什么 harness
|
71
Hilalum 4h 57m ago
gpt 和 claude 同时高强度使用十几个项目,虽然 gpt 差一点,但也差不了多少。你这不是被注水了就是 agent 的问题吧
|
72
NullIsLife PRO 有过类似的感受,一个 bug 实际上修改 10 几行代码即可. gpt 给我改了 10 几个文件上千行代码,单独的实现了一个分支功能.
opus fable 给我最大的感觉就是克制 |
73
goumadantui 4h 43m ago
500 行哈哈,我这随便十几个文件几千行上万行都是随便改,改完它自动执行用例自测,基本都是能完成功能的
|
74
Wh1t3zZ 4h 41m ago
鉴定为用中转站把脑子用坏了
|
75
jackOff 4h 35m ago
你这是不是掺水了豆包啊
|
76
hzzhzzdogee 4h 34m ago
@iyaozhen 现在 deepseek 哪个 harness 最适合呢. 各个评测/榜单, 说法都不尽相同
|
77
keethebest 4h 29m ago
笑死我了 智能机器人, 这个机器人靠谱保真吗
|
78
lemoncoconut 4h 16m ago
兄弟 币又不够用了?
|
79
deplives 4h 14m ago
|
80
94 4h 13m ago
多多少少是有点抽象的
|
81
OrangeDark 4h 12m ago
能工智人来了
|
82
cluulzz 3h 34m ago
|
83
cnevil 3h 22m ago 感觉已经塞后面了,等别人回复奖励自己
|
86
wwwwjack 3h 11m ago
看界面,有没有可能是你中转站的问题, 我反正用 gpt 经常单次改动超过 10-20 个文件, 代码都是几千行, 没出现过类似现象
|
87
Y25tIGxpdmlk 3h 6m ago
@izzzz #84 像是某个中转站的 web 对话窗口,看上去跟某些小网站的右下角智能客服窗口似的。嘻嘻
|
88
MaxJin 2h 52m ago
你这个是维护的代码吧,除非是各种代码累积出来的屎山代码,要不然连 GPT 不应该遇到这种情况。我之前遇到过用 ai 搞不定的就是屎山代码,因为内容多还在维护还要出新功能,文件关联的又多的那种会出现 ai 开始瞎写代码的情况。
|
89
Ketter 2h 42m ago
哥们连开一个官方正式的 codex 账号都不会啊?
|
90
EvaElfie 2h 30m ago
难绷,你的中转站都是掺假的你知道不?
常见的测试题测不出来的都给你路由了 |
91
mosesyou 2h 30m ago
咱能不用这些中转站了吗
|
92
i36lib 2h 30m ago
九成用的中转,掺屎了卖给你,你还以为是 codex
|
93
haidaomihuan 2h 10m ago
大概率你们项目一坨屎山、要么就是需求不明确(使用姿势不对)
|
94
lemolee 2h 7m ago
这模型现在就是一坨屎,每个任务都能搞出一个 BUG ,老子换 deepseek 了,效果都差不多,给 openai 送钱干毛
|
95
jmliang 1h 52m ago
这是 qwen 0.6b 吧
|
96
iyaozhen 1h 38m ago @hzzhzzdogee deepseek 我用得少。但肯定是适配了 Claude Code ,以及 DeepSeek 自家的。
哦哦 我们之前测试是 ChatGPT 系列,用不用 codex 差异较大 |