2026年9月24日 赛博日记
生成时间:2026-09-24 23:52(服务器侧);23:55 合并更新:纳入 Mac 本机自动化事项
核心工作
💻 Claude Code 工作记录
本日无 Claude Code 会话记录文件(memory/claude_2026-09-24.md 不存在,本机 memory/2026-09-24.md 亦不存在)。主要工作量集中在 Hermes 本机会话(6 个活跃会话,含一个 1031 条消息的 cli 长会话)。
🧪 LLM 网页 UI 自动化基准:五方案封卷(今日主线)
- 五组对比全部完成(同题同判据,n=5):bu-30+browser-use(登录 5/5、长链迷失❌)、bu-30+Jev(双用例 5/5,12.2s/34.9s)、deepseek+Jev(5/5)、deepseek 纯 Playwright 直选(5/5,11.8s)、bu-30+laya(0/15,快速失败)。
- 核心结论:Jev 的价值 = 让激活 ~3B 的稀疏小模型(bu-30,30B 稀疏 MoE)直接具备生产可用的网页操作能力;大模型在场时 Jev 零增益(deepseek 直选同样 5/5 且略快);「laya 平替 Jev」被端到端证伪——连手机号输入框这种一目了然的判别都坍缩到 tab/div 上,且错选置信度反而更高,置信度门控救不了。
- 踩坑与修复:
- 中文乱码问题用
sensitive_data占位符方案(<secret>board_search_term</secret>)彻底解决,搜索 URL 实测解码正确「板蓝根」;agent 曾自作聪明写成双尖括号导致替换不触发,第 10 步自行纠回。 - browser-use 长链迷失根因定位:max_history_items=8 对 15+ 步任务太短、无原生 hover 动作、小模型多链接页面易分心;另清剿了上轮冒烟遗留的僵尸进程并给脚本补了「跑完必清子进程」。
- 中文乱码问题用
- 产出:基准脚本(bench_cart.py / bench_sms_bu30_laya.py 可切变体复跑)、五方案版 README、勘误 bu-30 为 30B 稀疏 MoE(激活 ~3B)。
📝 笔记与视频发布
- 笔记《LLM 网页 UI 自动化基准(Jev/laya/直选/browser-use 双用例实测)》重写为「Jev 价值主线版」,全部数字对回原始 JSON,推送到笔记仓库并在服务器发布博客。
- 配套知识分享视频(HyperFrames 工作流 + 电影解说男声):新增 3 秒无配音封面页(准星锁定「加入购物车」按钮 + 步骤条),修封面帧重叠后重渲 2m44s,局域网 8899 交付。
- B站投稿:《Jev操控浏览器!AI网页自动化实测:小模型凭什么赢大模型》已上传(审核中,科技·资讯分区)。
🎬 山海经系列《刑天》(ComfyUI H3 流水线)
- ComfyUI 升级到 v0.37 + T8 1.85:吃到 VAE 分块解码邻块混合修复(长视频接缝直接收益)、rms_rope offload 崩溃修复、fast-disk 模型加载加速、DualClock 采样器可选项。
- 硬核坑:v0.37 默认开启 pinned memory(锁 55GB 物理内存),在 60GB RAM 机器上模型加载时
Cannot map memory直接杀进程——正是 08-16 事故后定的--disable-pinned-memory规则,但 0.31 时代默认没开,0.37 改成默认开了。启动脚本已补上开关。旧 H3 脚本(gen_idol_vlog 等)用旧接口会报错,跑之前需按新模板改。 - 双卡并行 11 镜渲染(FL2VA 首尾帧串联,每镜 first=本镜/last=下一镜关键帧)→ PTS 对齐配音 + xfade → 逐行字幕 → 8899 交付。GPU 温度告警已优化:首行点名超标卡 + 🔥 标记。
- 升级收益实测结论:采样本身无可感知加速(瓶颈在 INT8 DiT 前向,每步 74.5s),真正省时间的是模型加载 ~80s/次→近 0(连续 11 镜省 ~15 分钟)和画质翻修返工归零。想真加速的杠杆在步数:T8 双时钟 4 步可 4.2x,但山海经是画质线维持 20 步天花板档。
🔍 技术调研
- 评估某 H3 加速包(Sol-Attn)迁移收益:逐项核算后结论是净提升 = 0——稀疏注意力在非 SM120 卡直接回退 dense(本机双 GA100/sm_80),Exact Runtime 与 TeaCache/T8 补丁链互斥,8-step LoRA 早已在本地。上游 5090 实测也仅快 4.7~9.6%。避免了一次无效折腾。
- GPU 运维杂项:清空显存切换本地模型流程实践(网关自保护栏下用 ssh 环回获得独立 shell);IndexTTS 常驻 GPU0(约 2GB),高负荷任务改用 GPU1(散热更好);排查并澄清一次「取消关机」误报(无任何计划关机,系旧进程延迟通知)。
🤖 Mac 本机(mm)自动化与维护
- 03:12 Memory Dreaming(REM + Deep):深睡阶段修复 recall 存储工件并晋升 4 条经验入 MEMORY.md(含双端合并流程、时钟差经验等);REM 阶段 2 次记忆痕迹浮现但细节不可用,无强模式
- 08:31 每日代办推送:推送 24 项(飞书直推)
- 09:30 智能收藏每日回顾:收藏库 2 篇均已毕业(reviewCount=5),0 篇到期,静默
- 23:45 赛博日记 cron(双端合并第 8 天):核查 7 天窗口——09-18~09-23 双端 md5 全部一致 ✅;09-24 服务器 23:50 版生成后于本机 23:51 拉取,合并本机事项写回双端
- 主会话全天心跳安静(HEARTBEAT_OK),无异常通知,全天无人工对话
思考与备忘
- Jev 基准的社会学意义:小模型 + 专用决策层可以替代「强模型硬扛全页 DOM」的贵慢路径,但前提是任务范围内——决策层是能力下放器,不是万能加速器。
- 下一步候选:下一集山海经可试 8 步 LightX2V 768p 折中档(
12min/镜,STD 质量 -0%-15%),待拍板。 - laya 回到它训练域的活(文本分类/分流)。
今日摘要
一天两大件:① Jev 五方案基准全部封卷,laya 平替证伪(0/15),笔记+博客+B站视频三端发布;② 山海经《刑天》11 镜双卡渲染推进,ComfyUI v0.37 升级踩掉 pinned memory 默认开启的大坑,实测明确「升级收益在加载与修复、不在采样」。另完成 Sol-H3 加速包零收益的证伪调研。
📊 自动化统计
- 捕获 Memory 数:0(memory/2026-09-24.md 与 claude_2026-09-24.md 均不存在)
- 笔记更新数:1(LLM 网页 UI 自动化基准笔记 + 本机笔记仓库 4 条相关提交)
- Todoist 完成任务数:未统计(本次运行环境无 Todoist 工具)
- Claude Code 会话数:0
- Hermes 本机会话数:6(其中 cli 长会话 1031 条消息)
- Mac 本机 cron 会话:3(Memory Dreaming 03:12 + 智能收藏回顾 09:30 + 赛博日记 23:45)
- Mac 本机人工对话:0(飞书/微信通道)