V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  maolon  ›  全部回复第 7 页 / 共 20 页
回复总数  388
1 ... 3  4  5  6  7  8  9  10  11  12 ... 20  
那确实,之前在红迪上看到有人拿 seed dance 2 把妹非妹的崩坏集给重置了,这套东西再可控一点恐怕很多厕纸的外包就会大量使用这种方法来生产内容了
2 月 21 日
回复了 Winner4good 创建的主题 问与答 求文档 ai 率查验工具
没有 这些都不准,因为 ai 检测相对准确只有两种方法 1. token 级别的水印(需要提供商主动加入) 2. 开源模型知道本身 token 的分布

而这些网站/工具本质上就是拿大量的 ai 生成文章训练分类器,或者辅助通过检查文本困惑度和突发性来提供更强的 ai 文章信号,问题在于 llm 模型更新速度太快,每一代的新模型又是重新训练和微调的,基本上这些网站工具是很难跟得上进度的,准确度基本和扔硬币差不多

这个问题不应该使用工程手段而是应该通过管理手段来解决
当年打字员还是个职业呢,现在呢?
编程自然语言化和基础技能化那是必然趋势

但是会编程不代表你是程序员,更不代表你是软件工程师(虽然软工这个职业还存不存在可以另外讨论)
我觉得之前的 openai 的 5.3 codex spark 已经很有想象力了, 没想到这个更夸张
> 而是纯粹概率学上的堆砌
不对,至少有论文讨论 predict next token 是贝叶斯的

> 几乎全部 AI 回答都是走过去,所以短期内 AI 编程无法全自动化
不对,corner case 不能代表什么东西,以及这两个之间也不构成直接逻辑关系

每天看这种重复的讨论真的有点累了
是 powershell 的问题 现在大模型默认训练的是 posix 那套命令,powershell 的训的太少了经常出错,windows 下想正常用要不 wsl 要不 git bash
这个都不用问的,
全自主 agent 和超长程任务(> 15hr 持续执行)用 gpt 系列( 5.2 high/xhigh and/or 5.3 codex high/xhigh ),
copilot 模式(你和 agent 合作写)用 claude 的 sonnet 4.6 + opus 4.6,
另外建议搭配各家自己的套餐使用(也就是 codex 用 gpt 订阅,cc 用 claude 订阅),以及 opus 价格非常高,注意使用限制
2 月 19 日
回复了 383394544 创建的主题 OpenAI 各位现在还在用 GPT 还是转向别的 LLM
难道 gpt 没给你 personality 选项么, 你自己不去调去怪他和稀泥?
是总体降了(我不存在 ip 不干净的问题),然后 ip 不干净降的更厉害
@closedevice #47 对 都订阅了
2 月 16 日
回复了 typing 创建的主题 Claude 长期 Claude 用户试用了一下 ChatGPT/Codex
网页的这些任务你得用 pro 来搞,或者至少用 codex cli 提供的 5.2 high/xhigh(或者等他出 5.3), 网页的 thinking 感觉最近砍了不少能力。
5.3 codex 是纯粹的 working horse ,也就是说他最适合的是定义清晰的任务然后执行。另外 gpt 现在和 claude 走向不同的路数了,claude 是 pair coding 和 copilot, gpt 是自主工作 agent ,正确用法我觉得应该是给他设置一个目标,然后放着让他自己跑(目标设置得当他可以连续工作几天,以及是的,如果要用 gpt 系列就做好不看代码只看结果的准备,另外 gpt 比 claude 的优势在于在大代码库里他比较耐心会仔细查看所有的代码才开写而不像 claude 急冲冲的就开搞,在你这个应用场景下 claude 是优于 gpt 的)。
opus 是这样的 巨贵无比,连 max 20x 都撑不住一直这么用, 之前在 copilot 和 cursor 里用一天就能用完 pro 账号一个月的量。
但是怎么说呢,也确实物有所值,拿来做 plan 和 review 就挺好的,写交给 codex 就行了
2 月 15 日
回复了 SummerOrange 创建的主题 程序员 AI 编程后,我更累了
是的就是认知负荷超载了,比如管理里确实有提到“一个人只能管 7 个直属手下”,这就是因为虽然每个人能力不同,但是时间是有限的,5-7 个人差不多就把你一天的时间和精力都压榨完毕了(但是像皮衣黄他老哥就能管 100 多个人,所以每个人方法不同,结果就是不同的),
那么 AI 呢,你从一开始就没有觉得自己是在管理一个“人”,所以也就不会用合理的方法去管理他们,我觉得今年的主题应该就是如何把管理学里如何管人的经验挪进去变成如何管理一个 AI 的组织架构
@securityCoding 还真是留着过年 😂,过年前都要给用户添波堵你们智谱是有水平的
@unifly 你自己搜下他们最近干了啥就知道为什么骂了,看样子割韭菜没割到你头上说话就是轻松,啥事都来个什么大国叙事 smh
2 月 12 日
回复了 SayHelloHi 创建的主题 问与答 GLM-5: GLM Coding Max 套餐值得入手吗?
看他们在 v2 上的态度就知道了,就是来忽悠一波走人,之前搞抽奖都是没下文的
这话问的,这两天还为 gpt4o 下线又闹的沸沸扬扬呢,gpt4o 不就是 openai 最近最会舔用户的模型么,
另外你要不想 gpt5.2 舔你就把 personalitiy 切到 professional 去然后去接受拷打吧
codex 不如 gemini 你认真的? gemini 那个 cli 怕不是谷歌这些程序员自己都不用,都不用提任务成功率,光是这个 cli 就难用的要死
把几个话题凑在一起谈那肯定就是吵架啊
1. ds 在工程上,学术上,以及大模型历史上的贡献大不大?非常大,而且现在依然很大
2. ds 的模型现在市场上还强吗?并不强,第二梯队都靠后了
3. ds 的模型还有没有用途?有没有性价比?有,有
4. 推不推荐用 ds ?不推荐,有很多更好的选择
我觉得英文那个排版读的非常难受,一段话才几个词就强制换行了,另外答案好像整的有点太明显了,都是最长的那个,178 WPM, Hard
1 ... 3  4  5  6  7  8  9  10  11  12 ... 20  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   3051 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 95ms · UTC 13:50 · PVG 21:50 · LAX 06:50 · JFK 09:50
♥ Do have faith in what you're doing.