c0xt30a

c0xt30a

V2EX member #458937, joined on 2019-12-12 23:57:38 +08:00
Today's activity rank 2568
c0xt30a's recent replies
1h 15m ago
Replied to a topic by c0xt30a 随想 数学行会的工业化会是出路么?
抱歉耽误您的时间了。
@QingXuJiaZhi

不过这文章的目标读者是以后的我自己,可能跟您相性不太一样。
@VulcanEon 那个 96G 魔改版是真的么? 32G 5090 都要 $5000+ 了。
@zlo309618100727 在我这边 5090 做 fl2va 可以 5-6 分钟出 15 秒视频。ref2va 另算,如果输入里有视频,譬如要做绿幕,那么出 15 秒视频可能上半小时。当然用超分会快很多,但是我感觉质量差一点。
> 一句话:它不是单纯的提示词出图页,而是用于持续图片创作的本地工作台。

OP 可以考虑重写一下去 AI 味
OP 能做成 wasm 推理不需要服务端的么?
10 days ago
Replied to a topic by zzutmebwd Local LLM pro6000 部署 Qwen 3.8 flash next nvfp4
OP 是怎么设置 `partial_rotary_factor` 和 `factor` 到 512K ctx 的?
为啥只有一个暗色主题?
我这么算 tg:
- 1.2TB/s 的带宽
- dsv4-flash 的激活是 13B 的 fp4 ,大概是 6-7 GB
- 1M 上下文时候 bf16 kv 是 7 GB


所以不带 mtp:
- 在 ctx=0 时,1200/7 = 171 tok/s
- 在 ctx=1M 时,1200/(7+7) = 85 tok/s

参考:
- https://www.reddit.com/r/LocalLLaMA/comments/1svzlog/the_exact_kv_cache_usage_of_deepseek_v4/
OP 有没有考虑过全部上传到 tg 一个频道里?
自己存储太贵了
DeekSeep ......
Livid 你故意的么?
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   1250 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 20ms · UTC 17:03 · PVG 01:03 · LAX 10:03 · JFK 13:03
♥ Do have faith in what you're doing.