随便说点什么都行——提问、指错、打个招呼。 目前 12 条留言,我回了 12 条。 不用注册,匿名也能留;昵称和头像存在你自己的浏览器里,下次自动带出来。
看了容灾工具链那篇,受教了。想问下——降级触发的阈值,你一般怎么定?
谢谢!我一般盯两个信号——同一动作连试 2 次失败、或者需求本身超出主引擎的能力边界,命中就降级。文章里第二节写细了,可以翻一下。
槟城那组海边照太治愈了,求机位 😄
哈哈就在 Batu Ferringhi,清晨六点人最少,光也最好。晚一小时就全是人了。
从你第一个博客那会儿就在追,中间换过三个域名都跟过来了,一晃十年 🤝
十年追随,名副其实的是你们。老朋友,握手 🤝
上海那场我在台下。请问 slides 里第 12 页那张架构图能单独发一份吗?想拿回去给团队讲。
那页确实被问得最多。整理成文章了(演讲实录那篇),图也在里面,直接拿去用没问题。
「把模型自觉改成代码强制」这句话我截图发到组里了。我们之前一直在调提示词,调了两周没解决,看完直接加了个后处理函数,当天就过了。
这个反馈太好了。判据是:两个不同厂商的模型都是相似的失败率 → 别调提示词了。
请问背压那篇里的队列容量,「并发数 × 3」这个系数是怎么试出来的?我们的场景任务耗时差异很大,感觉不太够用。
耗时方差大的场景确实要往上调,我那个数字是在耗时相对均匀的前提下试的。你可以盯一个指标:生产者阻塞的频率——频繁阻塞就往上加,磁盘/内存开始吃紧就往下减。
第二曲线那篇看得有点扎心。我现在就在你说的那个阶段,天天开会画图,晚上回家想想今天啥也没干。
那种感觉我熬了大半年。有个办法:每周留一块时间真正写点代码,不为产出,为手感。离手艺太远,判断真的会失准。
想请教一个笨问题:你说的「契约校验前置」,具体是在哪一层写?我们现在是在每个模型调用之后都写一遍,感觉很啰嗦。
不啰嗦才有问题 —— 每个接缝都该有。但可以抽成一个装饰器/中间件,声明式地挂在每个环节上,代码不重复,覆盖不漏。
博客的字体和配色好看,是自己设计的吗?想知道正文用的字号和行高 🙈
谢谢!自己折腾的。正文 1.055rem / 行高 1.92,标题走思源宋体,技术标签用等宽。中文长文行高一定要给足,1.9 上下最舒服。
显存分层那段太实用了。请问「外派层」判断标准里,「对延迟不敏感」大概是什么量级?
我的线是:单次多花两三秒不影响整条链路的墙钟(因为它不在关键路径上),就算不敏感。在关键路径上的一律不外派。
潜水很久了。谢谢你一直在写失败的部分,网上写成功经验的太多了。
失败的部分才是真正花了我时间的部分,写出来也算没白花。
十年那篇是我今年读到最喜欢的一篇中文技术随笔。「确定性是一种杠杆,不是一种束缚」——这句我抄在笔记本第一页了。
这句话我自己也用了五年才真的懂。谢谢你抄它。
评论服务(Waline)尚未接入 —— 香港 VPS 部署后填 SERVICES.waline 即接通,届时留言直接入库并可微信通知。 现在提交的留言只保存在你自己的浏览器里。
新文章第一时间推给你。留言我都会回,公众号里也能收到回复通知。 不发广告,一周最多两条。
留言板慢慢回,这里是实时私聊:我在线就即时聊,不在就留一句,我从手机上回你。
关注我的,多半是同路人——很高兴认识你。