显影
容器给了 90 GB,ComfyUI 以为自己有 754 GB
ComfyUI 用 psutil 读内存,在容器里拿到的是宿主机的数。于是它所有基于内存压力的决策全部失效,缓存跨条累积,直到撞上限被 OOM 杀掉。这篇是一条查了四到六次才查对的真因、一次我自己做假了的验证、以及一个机器人 review 逼出来的两个洞。
我以为它挑格式,其实它只是嫌你说得太少
在一张 5090 上把 SenseNova-U1.5-8B-MoT 跑通。我先断言它只吃 JSON,然后用官方自己的 prompt 做了五组对照,把自己推翻了。真正管用的是写得多详尽,不是写成什么格式。
MiniMax Music 3 的三档文本编码器:代价不在音质,在时长控制
官方和社区都没说这三档该选哪个。我读 safetensors 头推出 pruned 是无损的,然后被五发 A/B 推翻——差的不是音质,是时长控制。
96GB 的卡贵一倍,只快了两成
两张卡同一颗芯片、显存带宽一模一样,一张 32GB 一张 96GB,租金差 2.15 倍。同一条 15 秒的片,贵的那张只快 19%,而其中 11 个百分点只是核心多了一成。多出来的 64GB 显存,在这活儿上值 7%。附一条我没料到的:换机器等于换片。
同一块卡上,我把两个视频模型摆在一起
LTX-2.5 比 MiniMax H3 快 8.5 倍,这个结论上周被我自己作废了,因为两个模型跑在两块不同的卡上。这次把 H3 装到 LTX 那台机器上重测。差距确实在,但更值得记的是:一个加速开关在四种组合下给出四个不同的倍数,我把其中一条当通则连着推广错了三次;而画质那一格,我亲手泄了自己盲测的底。这不是评测,是一次个人测试的过程与它的边界。
测 12 个开源出图模型,我把自己否掉了两次
要在本地找一个能替代云端 Seedream 的出图模型。开跑前查业界怎么做评测,发现自己那套测法有四个硬伤,返工了一遍;跑完五轮 255 张之后又发现,返工出来的那套判据,测的根本不是我要的东西。这篇是方法论的两次返工、十二格的实测数字、几个会静默骗人的坑,以及最后那个反直觉的结论。
LTX-2.5 能生成 41 秒,但那 41 秒剪不动
LTX 自家 API 最长给 20 秒,开源权重在自己的卡上跑到了 41 秒。可那 41 秒是一个长镜头——多镜头只在 15 秒以内成立,提示词写多密都救不回来。这篇是一条只改时长的单变量阶梯、一个把相关性当因果的返工,和几个不报错只是悄悄给你错数据的坑。
同一张 5090 上再装一个出图模型
在跑 MiniMax H3 的那张 RTX 5090 上加装 HiDream-O1-Image。2048² 出图 40 秒、显存只吃四成、中文招牌一字不差;顺带查清了 ComfyUI 在容器里被撑爆的真正原因。
一张 5090 把 MiniMax H3 跑到底
在 AutoDL 单张 RTX 5090 上把 MiniMax H3 开源版从装机跑到出片,七次实测、五个反直觉的发现,全程十块钱。