V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  maolon  ›  全部回复第 13 页 / 共 26 页
回复总数  506
1 ... 9  10  11  12  13  14  15  16  17  18 ... 26  
❮ ❯
当年打字员还是个职业呢,现在呢?
编程自然语言化和基础技能化那是必然趋势

但是会编程不代表你是程序员,更不代表你是软件工程师(虽然软工这个职业还存不存在可以另外讨论)
我觉得之前的 openai 的 5.3 codex spark 已经很有想象力了, 没想到这个更夸张
> 而是纯粹概率学上的堆砌
不对,至少有论文讨论 predict next token 是贝叶斯的

> 几乎全部 AI 回答都是走过去,所以短期内 AI 编程无法全自动化
不对,corner case 不能代表什么东西,以及这两个之间也不构成直接逻辑关系

每天看这种重复的讨论真的有点累了
是 powershell 的问题 现在大模型默认训练的是 posix 那套命令,powershell 的训的太少了经常出错,windows 下想正常用要不 wsl 要不 git bash
这个都不用问的,
全自主 agent 和超长程任务(> 15hr 持续执行)用 gpt 系列( 5.2 high/xhigh and/or 5.3 codex high/xhigh ),
copilot 模式(你和 agent 合作写)用 claude 的 sonnet 4.6 + opus 4.6,
另外建议搭配各家自己的套餐使用(也就是 codex 用 gpt 订阅,cc 用 claude 订阅),以及 opus 价格非常高,注意使用限制
2 月 19 日
回复了 383394544 创建的主题 › OpenAI › 各位现在还在用 GPT 还是转向别的 LLM
难道 gpt 没给你 personality 选项么, 你自己不去调去怪他和稀泥?
是总体降了(我不存在 ip 不干净的问题),然后 ip 不干净降的更厉害
@closedevice #47 对 都订阅了
2 月 16 日
回复了 typing 创建的主题 › Claude › 长期 Claude 用户试用了一下 ChatGPT/Codex
网页的这些任务你得用 pro 来搞,或者至少用 codex cli 提供的 5.2 high/xhigh(或者等他出 5.3), 网页的 thinking 感觉最近砍了不少能力。
5.3 codex 是纯粹的 working horse ,也就是说他最适合的是定义清晰的任务然后执行。另外 gpt 现在和 claude 走向不同的路数了,claude 是 pair coding 和 copilot, gpt 是自主工作 agent ,正确用法我觉得应该是给他设置一个目标,然后放着让他自己跑(目标设置得当他可以连续工作几天,以及是的,如果要用 gpt 系列就做好不看代码只看结果的准备,另外 gpt 比 claude 的优势在于在大代码库里他比较耐心会仔细查看所有的代码才开写而不像 claude 急冲冲的就开搞,在你这个应用场景下 claude 是优于 gpt 的)。
opus 是这样的 巨贵无比,连 max 20x 都撑不住一直这么用, 之前在 copilot 和 cursor 里用一天就能用完 pro 账号一个月的量。
但是怎么说呢,也确实物有所值,拿来做 plan 和 review 就挺好的,写交给 codex 就行了
2 月 15 日
回复了 SummerOrange 创建的主题 › 程序员 › AI 编程后,我更累了
是的就是认知负荷超载了,比如管理里确实有提到“一个人只能管 7 个直属手下”,这就是因为虽然每个人能力不同,但是时间是有限的,5-7 个人差不多就把你一天的时间和精力都压榨完毕了(但是像皮衣黄他老哥就能管 100 多个人,所以每个人方法不同,结果就是不同的),
那么 AI 呢,你从一开始就没有觉得自己是在管理一个“人”,所以也就不会用合理的方法去管理他们,我觉得今年的主题应该就是如何把管理学里如何管人的经验挪进去变成如何管理一个 AI 的组织架构
@securityCoding 还真是留着过年 😂,过年前都要给用户添波堵你们智谱是有水平的
@unifly 你自己搜下他们最近干了啥就知道为什么骂了,看样子割韭菜没割到你头上说话就是轻松,啥事都来个什么大国叙事 smh
2 月 12 日
回复了 SayHelloHi 创建的主题 › 问与答 › GLM-5: GLM Coding Max 套餐值得入手吗?
看他们在 v2 上的态度就知道了,就是来忽悠一波走人,之前搞抽奖都是没下文的
这话问的,这两天还为 gpt4o 下线又闹的沸沸扬扬呢,gpt4o 不就是 openai 最近最会舔用户的模型么,
另外你要不想 gpt5.2 舔你就把 personalitiy 切到 professional 去然后去接受拷打吧
codex 不如 gemini 你认真的? gemini 那个 cli 怕不是谷歌这些程序员自己都不用,都不用提任务成功率,光是这个 cli 就难用的要死
把几个话题凑在一起谈那肯定就是吵架啊
1. ds 在工程上,学术上,以及大模型历史上的贡献大不大?非常大,而且现在依然很大
2. ds 的模型现在市场上还强吗?并不强,第二梯队都靠后了
3. ds 的模型还有没有用途?有没有性价比?有,有
4. 推不推荐用 ds ?不推荐,有很多更好的选择
我觉得英文那个排版读的非常难受,一段话才几个词就强制换行了,另外答案好像整的有点太明显了,都是最长的那个,178 WPM, Hard
2 月 7 日
回复了 lmshl 创建的主题 › 🤖Vibe Coding › Vibe Coding 一年实践后的冷思考
挺好的感想, 我最近也在做 agent 实践测试(也是烧两家最贵的模型), 目前连续不停的的跑了一周, 目标是交给他一篇论文, 在工程层面上做出效果远超过论文提供的 benchmark 的结果。
结果是非常惊人的, 在 codex 和 cc 配合下他们确实逼近了我设定的一个目前不光论文没有实现,市面上开源的项目也都完全没有达到的 benchmark 值。
这说明 agent 不是不能达成全自动代理也不是不能完成超长程复杂任务而是他一定要有正确设计的反馈 loop , 比如在我的场景下就是 benchmark - 反思组合, 在大多数开发场景下就是 TDD 和 SDD 的合理使用
2 月 6 日
回复了 csh995426531 创建的主题 › OpenAI › 有玩了几天 codex app 的大佬吗,请教下
codex 之所以要用 worktree 是因为 gpt 有个不知算好还是坏的毛病, 他喜欢看当前工作区的情况 动不动就 git status --porcelain 一下, 然后如果你在一个工作区内开多个 codex instance ,而对方也改了文件,哦豁那就惨了。
他会认为工作区有多余文件不够干净然后 git reset 或者 git restore , 然后你前面辛辛苦苦弄的就都没了。 这个是他训练时候就这样,不是写 agents.md 就能完全解决的,为了避免惨剧发生用 worktree 保险
1 ... 9  10  11  12  13  14  15  16  17  18 ... 26  
❮ ❯
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   2940 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 37ms · UTC 13:35 · PVG 21:35 · LAX 06:35 · JFK 09:35
♥ Do have faith in what you're doing.