检测虚标U盘并复活它
Info 上个月为了身体健康,我去参加了免费的国民体质检测。体测结束后,主办方让我们在水杯、沐浴露、雨伞和 U 盘里选一份礼品。我一看 U 盘标着 32G,作为程序员,几乎没有犹豫就选了它。 拿回家后这盘子一直躺着。前几天要拷几个小视频,才想起来用。我本来就没指望它品质有多好,但没想到连容量都是假的。插上电脑,资源管理器里赫然写着 32G;可当我往里拷一个 1G 多的视频时,拷到一半就不对劲了——文件根本写不进去。这时候才反应过来:这是一块虚标 U 盘。 ...
通用控制看得到 Mac,就是连不上:两台 Codex 排查 IDS 注册故障
我的 Mac mini 和 MacBook Air 明明登录着同一个 Apple Account,也在同一个局域网里,Wi-Fi、蓝牙、Handoff 全都开着,但是鼠标推到屏幕边缘就是没反应。 不是偶尔抽风,是始终连不上。 一开始我以为又是显示器布局、推边方向或者 Universal Control 的开关没落盘。结果两台 Mac 来回查了一圈,最后真正修好的动作特别简单:在故障的 Mac mini 上登录 iMessage。 ...
Qwen3.8-27B 本地部署实测:vLLM、SGLang、单卡 Q4 与 DSH
Qwen3.8-27B 这个尺寸我等了挺久:27B 稠密模型还保留了足够的能力,量化后又能塞进单张 24GB 显卡,正好落在本地 Agent 比较实用的一档。 这次我在 4×RTX 3090 24GB 上部署了原始 BF16 权重,对比 vLLM 和 SGLang,又用单卡跑了一遍 Q4 GGUF。接口跑通后,还把同一个模型接进 WorkBuddy 和 DeepSeek Harness(DSH),测试看图、工具调用和真实文件任务。 ...
DeepSeek-V4-Flash 实测:八卡 RTX 3090 与双卡 RTX PRO 6000 差多少?
上一篇我把 DeepSeek-V4-Flash 塞进了八张 RTX 3090,结尾留下两件事:给 3090 测 DSpark 投机解码,再找两张 RTX PRO 6000 跑官方权重。 现在两个坑都填上了。 结果比我预想得更夸张: 八卡 RTX 3090 把 DSpark 参数调对后,固定长输出的单路 Decode 从约 36 tok/s 提升到 61.26 tok/s。 双卡 RTX PRO 6000 的最快方案跑到了约 204 tok/s,长输入 Prefill 也稳定在约 3K tok/s。 不过先说清楚:这不是一场严格控制变量的 GPU 跑分。两边使用的权重、推理引擎、DSpark 配置和虚拟化环境都不同。本文比较的是我实际能部署出来的两套方案,不是单纯比较 RTX 3090 和 RTX PRO 6000 的理论算力。 ...
八张 RTX 3090 本地部署 DeepSeek-V4-Flash:32K、64K、128K 实测
前两天还在纸面上计算 DeepSeek-V4-Flash 本地部署需要多少硬件,这次不继续算账了,直接上机器。 我最快能调动的本地算力就是八张 RTX 3090。为了腾显存,还把其中四张卡上常驻的 Qwen3.6-27B 服务停了。模型前一天晚上就开始下载,结果中途网络断掉,第二天又重新来了一遍。百兆网拉一百多 GB 的模型,确实很磨人。 ...