maolon's recent timeline updates
maolon
ONLINE

maolon

V2EX member #442547, joined on 2019-09-22 10:16:39 +08:00
Today's activity rank 750
maolon's recent replies
kimi 慢而且给的量少,glm 不谈最近的事工作非常可靠,而且它大量蒸馏了 5.6 sol (如果查模型指纹会被识别为 5.6sol ), 可以当成 5.6 的近似来使用,而众所周知 6 sol 是 terra 级别的模型有些场景还不如 5.6 , 那基本能当成 6 sol 平替了
2 days ago
Replied to a topic by jacketma › 商业模式 › Muse 是不是抄了 Manus?
因为 manus 那套本来就没啥门槛?
人 cursor 被老马收购前都知道这么玩下去是不行的搞了个自己的模型 composer 2.5 出来,manus 放着两年的优势然后啥也没做
2 days ago
Replied to a topic by ignore › OpenAI › gpt6 luna 和 gpt 5 sol 选谁效果好呢
luna 感觉没什么长进,而且还是那么慢,除了便宜也就只剩下便宜了,6 sol 倒是不错,思考短了,干活利索多了,不再是 5.6 时期不可用的状态,价格还便宜了
2 days ago
Replied to a topic by weiqi554177834 › 程序员 › Kimi Code 桌面客户端上线!
@S1ahs3r 之前试过 swarm 的规模不大,至少我这里( 199 )他就是几个角色一个一个安排上去做,和普通的 subagent 没啥区别
我觉得还是有区别的,特别是模型降智这种场景,最可怕的地方是当你发现他降智的时候他已经在代码库里拉了一坨了,而且可能是前一个请求好的后一个请求就坏了,这不是什么“流程改善”能避免的问题

而且之所以争这个就是因为每个模型他实现的速度,质量,价格,稳定性都不同,比如 luna 他可能非常便宜质量尚可,但是非常慢,比如 deepseek 他质量尚可而且快,但是需要指导(人长期驻守)而且越来越贵,比如 gpt 系列就不擅长前端,这些都是模型特性上的明显差距也是跑分看不出来的东西,而且每代模型都不同。

当然你说我就这个用途,在我的用途下区别不大那确实没问题,但是我认为对大部分人来说还是有区别的。
反正 2.5 pro 时代跑分那也是高的不行,但是实际能力只能说还行吧,和 glm 5.1 差不多可能稍差些,最后还是选了 5.1
4 days ago
Replied to a topic by clacf › 问与答 › mimo 的新模型是不是训练完了 DeepSWE 72.57
deepswe 的 1.1 连 gemini 3.8 都能跟 astra 平起平坐,笑笑就好了

而且 deepswe 老长时间没动静了,估计在搞 1.2,不然真的是让人看笑话
m 系列估计要到 m7 才算真正能上桌(但还是会很慢)
5 days ago
Replied to a topic by EyebrowsWhite › 问与答 › Jev 有没有已经上手用过的
@sampeng #19 llm 很多场景都是大炮打蚊子,特殊场景用特殊模型才是最优解。

我不爽 jev 就两点,一个是他的 api 居然收这么贵(作为这个特定的用途,特别是比较其他同类模型),二是他的隐私政策完全不透明,那么默认应该当成这次测试所有的请求他们都会拿来训练,就限制了很多用途我不想用他来做分类
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   1185 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 19ms · UTC 17:23 · PVG 01:23 · LAX 10:23 · JFK 13:23
♥ Do have faith in what you're doing.