Skip to content

Instantly share code, notes, and snippets.

View acmerfight's full-sized avatar

Gangqiang Yao acmerfight

View GitHub Profile
@acmerfight
acmerfight / session-abstraction-is-a-language.md
Created August 13, 2026 15:53
Session 抽象没有消灭细节:基于源码比较 DeepSeek Harness、Pi 与 Keel

Session 抽象没有消灭细节,它只是重新规定细节

从一篇低代码旧文,重看 DeepSeek Harness、Pi 和 Keel 的 Session 设计

《不要以 DRY 之名,发明低代码 DSL 去残害你的同事》批评的不是复用本身,而是这种复用:框架把业务行为藏进配置、模型和解释器,调用处只剩一个简单入口;开发者能快速完成常见路径,遇到例外时却必须先学会框架内部那门“语言”。

这套判断放到 Agent Session 上很有解释力,但需要加一个边界:不是所有封装都是 DSL。只有当封装自己定义了数据词汇、合法状态变化,以及恢复、压缩、分支等执行规则时,它才接近一门语言。

按这个标准,DeepSeek Harness、Pi、Keel 都在设计语言。区别不在“有没有 DSL”,而在这门语言是否明确、边界是否稳定、出错时能否解释。

@acmerfight
acmerfight / 7874-cold-restore-overflow-assistant.test.ts
Created August 11, 2026 16:28
Deterministic Pi cold-restore overflow assistant reproduction for earendil-works/pi#7874
import { existsSync, mkdirSync, rmSync } from "node:fs";
import { tmpdir } from "node:os";
import { join } from "node:path";
import type { AssistantMessage, Context, Message } from "@earendil-works/pi-ai/compat";
import {
type FauxProviderRegistration,
fauxAssistantMessage,
registerFauxProvider,
} from "@earendil-works/pi-ai/compat";
import { afterEach, describe, expect, it } from "vitest";
@acmerfight
acmerfight / pi-agent-ask-user-turn-boundary-stop.md
Last active July 31, 2026 09:07
Pi Agent、AskUser 与 shouldStopAfterTurn:从 Pipeline 启动到 JSONL 恢复(基于源码核对)
@acmerfight
acmerfight / gpt-5.6-sol-codex-usage-analysis-zh.md
Last active July 30, 2026 02:31
GPT-5.6 Sol Codex「典型使用时长增加约 18%」事件:工作人员公开说明、OpenAI 官网资料、公开源码、社区实测与证据边界

GPT-5.6 Sol 的 Codex 消耗问题:所谓“18%”究竟是什么?

一份严格区分 OpenAI 工作人员公开说明、OpenAI 官网资料、公开源码、社区测量与推断边界的中文分析。

核验日期:2026 年 7 月 30 日
公开讨论:openai/codex #36053

一、结论先行

2026 年 7 月 29 日,个人资料标注为“Codex & ChatGPT @OpenAI”的 Tibo 公开说明:GPT-5.6 Sol 在部分 Codex 工作负载中消耗使用额度的速度高于预期。该 X 帖子属于 OpenAI 工作人员的公开说明;OpenAI 同日发布的工程文章则是官网正式资料。

@acmerfight
acmerfight / claude-opus-5-context-engineering-analysis.md
Created July 27, 2026 15:59
Claude Opus 5 的「20 万字符系统提示词」,与官方“减少 80%”矛盾吗?——事实、口径与业界争议的完整分析

Claude Opus 5 的「20 万字符系统提示词」,与官方“减少 80%”矛盾吗?

结论先行

没有严格的逻辑矛盾,但存在明显的统计口径错位,以及值得警惕的营销表达张力。

Anthropic 的窄口径主张——“面向 Opus 5、Fable 5 等前沿模型,Claude Code 的核心系统提示词减少了 80% 以上”——有独立测量提供方向性支持。
但如果把这句话理解成“Claude 的完整首轮上下文、上下文占用或 token 成本减少了 80%”,现有证据并不支持。


@acmerfight
acmerfight / databricks-coding-agent-benchmark-analysis.zh-CN.md
Created July 22, 2026 06:51
Coding Agent 评测真正测的是什么?Databricks 多百万行代码库 Benchmark、HN 讨论与延伸研究完整解读

Coding Agent 评测真正测的是什么?

Databricks 多百万行代码库 Benchmark、Hacker News 讨论与延伸研究的完整解读

复核日期:2026-07-22
原文发布日期:2026-07-08


摘要

@acmerfight
acmerfight / skill-system-gist.md
Last active July 12, 2026 01:20
Keel 的技能系统:一个可治理、可度量的 Agent Skill 运行时——与业界对比(基于事实,附来源)

Keel 的技能系统:一个可治理、可度量的 Agent Skill 运行时

在 issue #430 落地之后,Keel 的技能系统在业界处于什么位置——只讲事实,附来源,并诚实区分「已交付」与「计划中」。


说明:这份文档是什么

本文描述的是 Keel 在公开设计(issue #430)中已承诺的技能运行时,以及 Keel 当前已交付的部分。它不声称下面每一项能力都已经合并。

@acmerfight
acmerfight / mobile-control-guide.md
Last active June 21, 2026 15:18
从 iPhone 远程控制 Claude Code & Codex CLI 完整指南(Mac + iPhone)

📱 从 iPhone 远程控制 Claude Code & Codex CLI 完整指南

适用场景:Mac 作为开发主机,iPhone 作为移动控制端
前提条件:Codex 官方订阅 + Claude Code (API Key)
总费用:$0(全部组件免费)
实测环境:macOS 15 + iPhone 15 Pro Max + Tailscale 1.98


架构总览

@acmerfight
acmerfight / article_analysis.md
Last active July 31, 2026 03:46
「AI 的时代,还有东西是不变的么」深度拆解 — 反常识观点与核心 takeaway

「AI 的时代,还有东西是不变的么」深度拆解

原文作者:一位在硅谷/北京的产品设计师创业者(字节、Dropbox Growth、Yahoo、CMU),正在做 AI Agent 产品。 以下分析基于原文逐段拆解,案例均来自作者自述的实践经验。


I. 最反常识的三个点

段永平「敢为天下后」vs 王慧文「先冲进去试一试」

从方法论分野到 AI Agent 时代的策略选择


一、两套方法论的本质

段永平:以确定性换时间