MoreRSS

site iconNicksxs修改

浙江大学。10 年软件开发经验,曾在多个行业担任技术架构设计和团队管理。
请复制 RSS 到你的阅读器,或快速订阅到 :

Inoreader Feedly Follow Feedbin Local Reader

Nicksxs的 RSS 预览

Qwen-Image 2.1 入门:从一句提示词到一张图,6GB 显存为什么也能跑

2026-09-27 20:00:00

从普通人的视角解释 Qwen-Image 2.1 如何把一句提示词变成图片,文本编码器、DiT 和 VAE 为什么缺一不可,以及 RTX 3060 6GB 配合 32GB 内存如何通过 Unsloth Desktop 和模型卸载跑起来。

Jev 深度解读与实测:只做判断的 AI,究竟快在哪里

2026-09-20 20:00:00

从重复扣费工单出发,解释 Jev 的类型化判断、并行输出与概率校准,并记录 TypeSafe skill 安装和六条中英文样本的真实 API 结果,区分本机体验与官方性能评测。

Pi Agent 源码解析(一):从调试环境到双层主循环

2026-09-13 20:00:00

从源码搭建 Pi Agent 调试环境,并沿着 cli.ts、sdk.ts、agent.ts 和 agent-loop.ts 的真实调用链,分析模型配置、StreamFn 注入、双层 Agent Loop、流式响应和工具调用。

6GB显存能跑35B MoE吗:FreeToken极限配置、性能压榨与实操教程

2026-09-05 10:00:00

6GB显存可以尝试运行Qwen3.6-35B-A3B-NVFP4,但代价是更小的专家缓存和KV容量,以及对32GB以上内存、CPU与PCIe带宽的更高依赖。本文给出已验证配置、调优顺序、压测脚本和明确限制。

从ASM到ByteKit再到Arthas:一条Java字节码增强链路

2026-08-30 15:10:00

之前写过几篇 Java Agent 和 Javassist,也单独介绍过 Arthas 的 vmtool。这些内容放在一起看,会发现它们其实一直围绕着同一个问题:

8GB显存如何跑35B:深入理解FreeToken的专家缓存与CPU-GPU协同

2026-08-23 20:41:00

前几天看到一个挺夸张的结果:FreeToken 在一台只有 8GB 显存的 RTX 4060 Laptop 上运行 Qwen3.6-35B-A3B,解码速度达到了 39.3 tok/s。