手把手教你从零开发一个 Agent(0):Responses API 与多轮对话记忆
本系列应该会放 Coding Agent 的教程,以及如何开发一个 Agent,后续会往 pi-agent 的实现思路继续学习。 我会按真实开发经历梳理记录,并尽量从需求倒推实现。这样比较好理解,但弊端也很明显:我会在这个过程中踩坑,而且有些坑可能要过一阵子才意识到。再叠个甲,笔者也是小菜鸟,如有错误,欢迎指出。 ...
Git 合并策略怎么选:merge、squash、rebase 的区别
我本地刚提交了一点东西,还没 push,为了保持 git 链路干净,我执行 git pull --rebase,我对他的概念不够透彻,然后冲突了。 打开 VS Code 一看: Current Change 不是我刚写的 Incoming Change 反而是我刚写的 第一反应是:这不对吧??? 后来才发现,不是 VS Code 标错了,是我一直把 Current 和 Incoming 脑补成了“我的”和“别人的”。这两个词对我这个英语菜鸟而言真的很容易把人带歪。 ...
25GB 内存就能跑 GLM-5.2?我在 RTX 3060 上实测了 744B MoE
先说结论:能跑是真的,能不能用是另一回事,别抱太大期待。 在我的 RTX 3060 开发机上,GLM-5.2 744B 最终跑到了约 0.44 tok/s。工程上挺有意思,但离正常聊天还差得远。 这里的“25GB”是项目宣称的最低量级,不是我的整机占用。本次 Linux 可见约 39GiB,进程 RSS 约 27GB;它适合验证 MoE 路由、缓存和磁盘流式推理,不适合交互聊天或 Agent。 ...
人脸识别为什么要眨眼还要闪各种颜色的光
今天办业务需要人脸识别,拿起手机把我的小胖脸放入框中眨眨眼,等待灯光闪烁,随后就是通过,这个已经见怪不怪了,偶尔还要张张嘴,左右摇头,我知道他这是在确认我是不是真人,但是哪怕我做过简单的人脸识别,我也没有深究过人脸活体检测具体有多少方法,以及闪光是在干嘛,本文对此做了调研和解释。 ...
vLLM + Qwen3.6 视频推理踩坑记录
vLLM + Qwen3.6 视频推理踩坑记录:AV1、OpenCV 与视频采样问题 Info 之前 qwen3.6-27b 模型发布后没多久我就部署他 并且测试过视频能力,一直是公司内部署的主力离线大模型。 所以我认为一直可用,但是今天同事提了个新的需求,要从视频中找出属于广告部分的内容裁剪掉。我首先给出的方案是 用 Qwen3-ASR+Qwen3-ForcedAligner 模型来获取 文本内容以及时间轴,再用 LLM 来判断哪些文本属于广告内容,随后根据文本所对应的时间轴裁剪视频,先这样子给同事搭建了环境让他去跑几个试试,同时我来试试直接让 qwen3.6 读视频是否可行。结果一来就给我个报错 ...