文章
所有文章。
-
[论文精读] RegCache:Vision Encoder 做激活量化,为什么需要 Prefixing Registers
更新于:RegCache 发现视觉编码器中的高范数 outlier 会严重放大量化误差,并通过中间层 prefix registers 和 token deletion 改善 CLIP、SigLIP、DINOv2 等模型的低比特量化。
-
[论文精读] Vision Transformers Need Registers:给 ViT 加几个工作寄存器
更新于:Vision Transformers Need Registers 解释 ViT 中背景高范数 token 的来源,并用额外的 register tokens 把模型的隐式工作空间显式化。
-
project 的 GitLab CI/CD 与 Python 包发版流程
记录 project 从专用 GitLab Runner、部署回归,到 wheel 构建、隔离验证、包发布和 Release 创建的完整流程。
-
Agent 时代的基础设施:从 lark-cli 看执行 Harness 应该怎么建
Agent 需要的不是更多工具,而是一条可验证、可约束、可恢复的执行链。以 lark-cli 源码为例,拆解命令层、身份、策略、输出契约与测试如何组成 Harness。
-
QAIRT 2.42 适配 Streaming Spatial Speech Enhancement Network 的 GRU
Streaming Spatial Speech Enhancement Network 的 HTP 部署排查:GRU 展开、长序列 native cell、QAIRT 源码开关、Einsum layout bug 与流式 I/O 对齐。
-
MNN QNN 里为什么 chunk size 会影响 PPL
记录一次 Qwen3-0.6B 在 MNN QNN 上排查 PPL 异常的过程,解释为什么 chunk size 不只是输入切块参数,而是同时决定 prefill 图 shape、padding 路径和 ppl_eval 的上下文窗口,因此会真实影响困惑度。