2026-09-21(周一)赛博日记
生成时间:2026-09-21 23:52(服务器侧);09-22 00:05 合并更新:纳入 Mac 本机(mm)自动化事项
核心工作
💻 Claude Code / Cursor 工作记录
- 统计:Claude 0 个 / Cursor 9 个会话,共 197 条消息,主力项目
ysbapitest(API 自动化测试平台,代称项目X) - 核心进展:
- 短信验证码链路打通:本机 redis-cli 可连测试 Redis,成功从 Redis 查出注册短信验证码;随后落地了「查短信验证码」Skill 并再次清理了 Redis 数据
- 场景执行白名单 Bug:场景 23(注册账号)中
smsCode节点能被 ScenarioRunService 执行,但 TestPlanService 保存计划时的动作白名单没放行,导致保存被拦成 403——定位到白名单缺项,已修复 - AI 生成页调整:去掉右上角「模块」输入框,落库默认
default - 等待节点排查:等待节点本身能跑,这次失败是流程没执行到它
- 多次提交推送 origin/main(含
77e08b3、79db73c等),AI-TEST 项目完成提交发版
🤖 本机 Agent(Hermes)工作记录
- browser-use bu30b 中文乱码根治(今日主线):
- 根因确诊:
bu-30b-a3b-preview是 browser-use 官方英文微调模型(README 标language: en),Qwen3-VL-30B-A3B 基座的中文能力被微调稀释——日志乱码模式(拼音+ASCII碎片混排)是典型小词表英文模型硬生成中文的症状 - 正解落地:browser-use 0.13.8 内置
sensitive_data占位符机制——LLM 只输出<secret>KEY</secret>纯 ASCII 占位符,执行层_replace_sensitive_data替换成 Python 侧真实中文再入框,模型全程零中文生成。单测通过;沉淀到 skillbrowser-use-bili(坑4)和模板templates/chinese_safe_input.py - B站端到端实测:登录态过期导致重定向,Agent 撞验证码并自编不存在的 URL(再次印证模型缺陷);扫码恢复登录态后全测试日志扫描确认页面操作零乱码,仅日志叙述侧有轻微漂移
- 性能实测(双卡 PP2 部署):decode ~150 tok/s(147-184),prefill 长上下文 10.3k tok/s,prefix cache 命中 15-17%、MM cache 40%——对 browser-use 单步 10-15 token 的动作负载非常富裕,瓶颈在页面加载/截图;对比 flash-next 中文 ~120 tok/s 反而更快(A3B 激活 3B),但中文生成不可用
- 根因确诊:
- 启动脚本修复:bu30b 三个启动脚本引用的死 venv(
/root/cmp170hx-bench/venv,09-17 AWQ 归档时被清)改指/root/vllm029-venv(0.28.1 原生支持 pack-quantized w8a16) - 模型调度:bu30b 退出,双卡切回 FlashNext 生产栈(NVFP4 @ :8000,270 秒就绪,登记
qwen3.8-flash-next512K),全局模型已切本地。注意 browser-use 线路与 FlashNext 抢双卡显存,二选一 - Tailscale 网络维护:在线 4 台(本机、macbook-air、SS 节点、新上线的 Windows VOD 设备);为该 Windows 配置 SSH 免密(别名 ysb,凭据已脱敏)
- Hermes/上游版本调查:桌面版 0.7.0 → 上游 v0.9.0(今日刚发布),但 apt 源无法确认发布渠道,升级前需核对;网关维持冻结在 0.19(0.20 有僵尸崩溃问题)
- 待办清理:删除 25 条 LangGraph 学习任务(Day4~Day28)和 5 条重复闹钟,代办合集收敛到 5 条
📚 智能收藏回顾
- 整理 B 站视频笔记《30天夺回身体控制权(精力重启指南)》并推送(commit
cc59178):- 核心理念:疲惫多为「假性疲劳」,解法是系统化减法而非进补
- 三阶段:断舍离(戒糖/数字日落/晨光)→ 能量重构(4-7-8 呼吸/16+8 断食/HIIT)→ 固化(心理锚点/8-2 法则)
- 注:内容基于评论区两条高赞总结交叉整理,已标注非医学建议
🤖 Mac 本机(mm)自动化与维护
- 08:15 每日代办推送(周一):LangGraph 28 天学习计划(Day 4+:Node/Edge 基础、条件路由、问答 Agent、第 1 周总结;Day 8~14 State 深入/LLM 集成/Tool Calling/Checkpointing;后续至 Day 28 LangSmith/生产实战)、回归用例自动化维护汇报、刘小艳班次闹钟 ×5。⚠️ 微信通道仍未修复(连续第 5 天),改由飞书直接推送,不影响接收。(注:其中 LangGraph 25 条与闹钟 5 条已于今日晚间在 Hermes 侧代办大扫除中清理,早间推送为最后一次完整展示)
- 09:30 智能收藏每日回顾:
smart-collect.js运行正常,0 篇到期,收藏库 2 篇均已毕业归档(reviewCount=5),维持静默期 - 23:45 赛博日记 cron:拉取服务器 23:52 版本(本机时钟快约 7 分钟),合并本机事项后写回本地+远程(双端合并模式第 5 天)
- 主会话全天心跳安静(HEARTBEAT_OK),无异常通知,全天无人工对话
思考与备忘
- browser-use 中文乱码问题的最终范式:不要让英文微调模型生成中文,用占位符把中文生成彻底移出模型职责边界——这个思路可推广到其他小词表/专项微调模型
- 双卡资源是硬约束:bu30b 与 FlashNext 互斥,下次投稿前若要端到端验证 bu30b 需切模型(5 分钟加载窗口)
- Hermes 桌面版 v0.9.0 来源待核实(hermesagent.org.cn vs GitHub CN Desktop 仓库),网关 0.19 冻结规则不动
今日摘要
双线并行的一天:白天 Cursor 主攻项目X 的自动化测试链路(短信验证码 Skill 落地、场景白名单 403 修复、AI 生成页简化),晚上 Hermes 深挖 browser-use bu30b 中文乱码——从根因确诊(英文微调稀释中文能力)到官方 sensitive_data 占位符正解落地,顺带修了启动脚本死 venv、实测了双卡 PP2 性能(~150 tok/s decode),最后切回 FlashNext 生产栈。待办面收敛明显,还整理了一篇精力管理笔记。Mac 本机侧自动化全线正常(代办推送、收藏静默、心跳安静),全天无人工对话。
📊 自动化统计
- 捕获 Memory 数:1(服务器侧,含 Claude 记忆汇总文件)
- 笔记更新数:1(精力重启指南视频笔记,commit cc59178)
- Todoist 完成任务数:0(今日 2 条到期任务未勾选:互踢测试、灰度回归);代办大扫除删除 30 条(LangGraph 25 + 闹钟 5)
- Claude Code / Cursor 会话数:9(197 条消息)+ Hermes 活跃会话 5 个
- Mac 本机 cron 会话:2(智能收藏回顾 09:30 + 赛博日记 23:45)
- Mac 本机人工对话:0(飞书/微信通道)