sentinelKV2EX member #631792, joined on 2023-05-30 20:41:02 +08:00Today's activity rank 12187 |
| “马鞍税”,一篇非常有意思的 harness 横比文章 程序员 • sentinelK • Sep 18 • Lastly replied by greentim | 9 |
| 很好奇小米开放的这个实时训练监控器,其中成本(cost)的组成: https://mimo.xiaomi.com/rl/#overview 程序员 • sentinelK • Sep 17 • Lastly replied by lwep | 8 |
| deepseek-flash 的第三方跑分趣闻 DeepSeek • sentinelK • Sep 11 • Lastly replied by sentinelK | 3 |
| mac m5 ultra 上线中国官网。1.2T 显存带宽, 256GB 版本 8.6 万 Local LLM • sentinelK • Aug 28 • Lastly replied by sadan9 | 51 |
| RTX PRO 5000(或其他 48GB 显存)的 Qwen3.8-27B-FP8 配置交流(prefill 5000+t/s, decode 60+t/s)
1 Local LLM • sentinelK • Aug 26 • Lastly replied by tgfbeta
|
55 |
| OpenCode go 订阅开始区分模型提供额度, kimi-k3、deepseek-v4-pro 等只有 15$的额度,请各位注意用量。 程序员 • sentinelK • Jul 20 • Lastly replied by shuck | 49 |
| lama.cpp 目前有重大性能 bug: checkpoint 的巡回逻辑对于混合模型(比如 qwen3.6-27B)无效,从而导致大概率每次对话都要 prefill 全文,严重拖慢速度 Local LLM • sentinelK • Aug 3 • Lastly replied by tgfbeta | 16 |
| 阿里百炼的自建 DeepSeek 限速是 TPM 1.2M,这限速是拍脑袋的吗? 程序员 • sentinelK • May 28 • Lastly replied by sentinelK | 2 |
Sep 30 Replied to a topic by YanSeven › 程序员 › 又是 bot,又是 muse,又是啥啥啥的,不就还是云端龙虾+企业直接协商好了各种用户账号的授权协议之类的吗 |
Sep 29 Replied to a topic by yiranw09 › 程序员 › 继 opencode go 之后, commandcode goat 也搞欺诈 |
Sep 28 Replied to a topic by yiranw09 › 程序员 › 继 opencode go 之后, commandcode goat 也搞欺诈 |
Sep 24 Replied to a topic by ghmum › OpenAI › 想用 ds4.1,应该用哪个 harness? |
Sep 23 Replied to a topic by viskem › OpenAI › 相比旗舰模型,低端模型更会说人话? |
Sep 23 Replied to a topic by viskem › OpenAI › 相比旗舰模型,低端模型更会说人话? |
Sep 23 Replied to a topic by viskem › OpenAI › 相比旗舰模型,低端模型更会说人话? |
Sep 22 Replied to a topic by chenglus › 程序员 › AI 时代,移动开发用 React Native / Flutter / 原生 |
Sep 22 Replied to a topic by muyangquan › 程序员 › 为啥 codex cli 总莫名其妙停工, DSH 和 Trae 没事 |
Sep 21 Replied to a topic by FaustinaD › AirPods › Airpods5 到手,说下感受 |