| RSS |
| strata 极致优化指南(参数篇)64GB RAM + RTX pro 5000 48GB, IQ3_XXS 量化, prefill 4500t/s, decode 180t/s 同时缓存 5 个 262k 会话不重新 prefill sentinelK • 6h 36m ago • Lastly replied by liuhuanting | 9 |
| 小模型训练、蒸馏、微调的需求大吗?目前想训练自己的模型、又觉得成本太高放弃或犹豫的团队多吗 qwzhang01 • 1 day ago • Lastly replied by 2ruowqe9r | 1 |
| 有什么本地部署好使的写代码小模型吗? 24GB 显存玩玩那种 52txr • 6h 20m ago • Lastly replied by liuhuanting | 16 |
| 2 万块以内,可以本地部署的最好的模型是哪个? jedeft • 3 days ago • Lastly replied by uprit | 9 |
| 有没有人装过 Strata + Qwen3.8-Flash-Next 125b?我遇到的问题是在 workbuddy 里一直超时。 zktz • 5 days ago • Lastly replied by passive | 8 |
| pro6000 部署 Qwen 3.8 flash next nvfp4 zzutmebwd • 1 day ago • Lastly replied by jinsongzhaocn | 56 |
| 人人编程 VS AI SaaS,真的有优势吗? jacketma • Sep 30 • Lastly replied by 94 | 4 |
| 有用 mac 跑 minimax H3 的吗,好后悔买了 48G 内存的 macbook lightzh • Sep 22 • Lastly replied by chapiom | 39 |
| 2 台 DGX Spark 上运行的本地 LLM 横向对比 ldm0 • Sep 30 • Lastly replied by peyppicp | 32 |
| 部署 Qwen3.8-27B 模型死循环问题最新升级 jinsongzhaocn • Sep 30 • Lastly replied by jinsongzhaocn | 6 |
| deepseek v4.1 Flash 发布了 Insolitude • Sep 12 • Lastly replied by CyouYamato | 4 |
| 老哥们,预算 3w 左右想弄一套小型化本地大模型硬件,求推荐 turing518 • 4 days ago • Lastly replied by WhatIf | 21 |
| mac 本地部署 llm 不是最佳选择 Need4more • Sep 27 • Lastly replied by ChriskurtDave | 91 |
| qwen3.8 本机部署后搭配什么搜索工具呢? idblife • Sep 4 • Lastly replied by wises | 19 |
| DeepSeek-V4-Flash-Vision-Exp 权重开源了,原生视觉集成
TGOcc PRO |
4 |
| 大模型 LLM 是怎么实现计算的?还是内部调用了工具? jacketma • Sep 1 • Lastly replied by CasualYours | 15 |
| 两台 dgx-spark 部署满血 deepseek v4 flash 完全指南,稳定 60~70tok/s 单流 dbow • 2 days ago • Lastly replied by Lrony | 67 |
| 个人是否应该投资购买 DGX Spark 之类的硬件来跑开源模型?既是自用,也是某种防止硬件涨价的投资? sillydaddy • Sep 15 • Lastly replied by prosgtsr | 67 |
| 自己攒了个 comfyui 交流社区 nicolaszhao4 • Sep 7 • Lastly replied by neptuno | 19 |
| mac m5 ultra 上线中国官网。1.2T 显存带宽, 256GB 版本 8.6 万 sentinelK • Aug 28 • Lastly replied by sadan9 | 51 |