每日 Harness 开源 · Source
全部刊期 · All issues

每日 Harness

2026-06-29 · Monday, June 29, 2026

智能体基建与边界

视图 · View

今日重点 · Today's Highlights

[Programmable Probabilistic Computer with 1M p-bits](https://arxiv.org/abs/2606.25313)[^1] - 百万 p-bit、万亿级 flips/s 的分布式 FPGA Ising machine,把概率计算从单芯片容量问题推进到通信频率与采样精度的系统设计问题。

全文 ↓

[NanoEuler](https://github.com/JustVugg/nanoeuler)[^2] - 从 BPE、反向传播到 CUDA FlashAttention 都手写的 GPT-2 级训练管线,适合看清一个小语言模型从数据到 SFT 的完整机械结构。

全文 ↓

[Caliper](https://github.com/edonadei/caliper)[^3] - 用 pass@k、baseline 和隔离 transcript 把 agent skill 的“今天能跑”变成可回归的可靠性指标。

全文 ↓

[Agent Memory Bench](https://github.com/Kausha3/agent-memory-bench)[^4] - 直接测试 retraction、collision、recall、conflict 四类记忆失败,比单纯检索相关性更贴近 agent 长期记忆的真实风险。

全文 ↓

[CodeGraph](https://github.com/colbymchenry/codegraph)[^5] - 本地预索引代码知识图谱,为 coding agents 提供可复用的结构化代码上下文,目标是减少反复扫描仓库带来的 token 与工具调用成本。

全文 ↓

论文 · Papers

1 项 · 论文

本期重点Programmable Probabilistic Computer with 1M p-bits1arxiv.org原文 ↗

arxiv.org

这篇论文实现了一台由网络化 FPGA 组成的可编程概率计算机,把 Ising machine 扩展到 1,000,000 个 p-bit,突破了单芯片容量与内存带宽限制。系统执行 Gibbs sampling 的速度超过每秒一万亿次 flips,耦合权重留在本地片上内存,设备之间只交换 1-bit 边界状态。论文用三维 Edwards-Anderson spin glass 证明边界交换频率与本地 p-bit 更新频率的比值 eta 决定分布式机器何时能匹配单体 GPU reference,并把不足频通信下的能量下降退化建模成可量化的吞吐-精度权衡。它值得一看之处在于,硬件扩展问题被表述为随机动力学的通信设计规则,而不是只报告更大的 p-bit 数字。

开源 / 项目 · Projects

15 项 · 开源 / 项目

Bash4LLM+6github.com原文 ↗

github.com

Bash4LLM+ 是一个单文件 Bash wrapper,用 curl/jq 调用 Groq 的 OpenAI-compatible Chat Completions API,并可扩展到 Gemini、Hugging Face、Mistral 等 provider。README 强调它不 hardcode 模型,而是通过 `GET /openai/v1/models` 动态拉取列表,同时支持 streaming、non-streaming、长输出自动保存和 ui_state JSON 元数据。更有价值的是它把“终端里快速接 API”做成可审计 shell 工具,安全设计里明确避免 `/tmp`、`eval`,并针对 Termux 用目录锁绕开 `flock` 的 Android 限制。

本期重点NanoEuler2github.com原文 ↗

github.com

NanoEuler 从零实现 GPT-2 风格语言模型,核心不依赖 PyTorch、autograd 或 ML 库,而是手写 forward/backward、byte-level BPE、预训练和 supervised fine-tuning。CUDA 版本包含 cuBLAS matmul、RMSNorm、RoPE、grouped-query attention、手写 tiled FlashAttention、SwiGLU、softmax/cross-entropy 和 AdamW;README 称 FlashAttention 让训练 step 约快 3 倍,GPU 梯度与 CPU reference 校验到约 1e-6。作者也把边界说清楚:约 116M 参数、单 RTX 4070 训练的模型只是 GPT-2-small 气质的文本生成器,不是实用助手。这个项目的实质价值在于工程可解释性,所有参数、梯度、tokenizer、kernel 和 SFT 流程都能逐层读到。

Use-zerostack7github.com原文 ↗

use-zerostack 是一个 agent skill,把 Claude Code、Cursor 等 coding agent 的 slash command 映射到 zerostack CLI,让主 agent 可以把实现、计划、审查和复杂编排委派出去。README 给出的命令面很小但明确:`/zs:code`、`/zs:ask`、`/zs:plan`、`/zs:review`、`/zs:parallel`、`/zs:orchestrate` 分别覆盖写代码、只读问答、计划、review、隔离 worktree 和多子代理任务。它的看点在“agent 调 agent”的接口层,而不是模型能力本身:复杂任务可以被拆成具备执行语义的 CLI 调用,便于记录、重复和隔离。

Snarl8github.com原文 ↗

github.com

Snarl 是一个 SHACL Core validator,使用 SLOP 编写并编译到 C,用来验证 RDF/知识图谱中的 shapes constraints。它的定位很窄:把语义网数据质量检查做成轻量 native validator,而不是依赖大型运行时或服务。SHACL Core 本身覆盖节点形状、属性约束和图数据一致性,这类工具若能以 C 形态部署,适合嵌入数据管线、边缘环境或资源受限的知识图谱校验流程。

本期重点Caliper3github.com原文 ↗

Caliper 把 agent skill 可靠性测试产品化:同一任务运行 k 次,计算 pass@k,并可同时跑 baseline 判断 skill 是否真的改善了裸 agent。README 示例中 “With skill” 为 98%、“No skill” 为 55%、Delta +43%,任务规格支持 LLM judge 的 `expect:`,也支持本地 Python `assert:` 做确定性检查。每次 attempt 会在隔离临时 home 中运行并保存 transcript 和 JSON 结果,因此它不只是一次性 demo runner,而是能放进 skill 迭代周期里的回归工具。它值得上手的地方在于把提示词、skill 文件和 agent 版本变化造成的随机性变成可比较的实验数据。

Shikhu9github.com原文 ↗

Shikhu 是 CLI 加 `/shikhu-study` agent skill,目标是帮助开发者学习自己或 AI 生成的代码库。它用 Mercury API 读取源码生成摘要和概念性多选题,用本地 SQLite 的 `coverage.db` 跟踪 knowledge coverage;每个文件需要 3 个 golden questions 才算 fully covered。README 还描述了 SHA-256 内容哈希带来的 staleness 机制:文件变更后旧题和 golden 会被标记为待复验,而不是继续假装理解仍然有效。这个项目有意思的点在于,它把“我看懂这段 AI 代码了吗”转成可复测的覆盖率,而非依赖主观信心。

GalaxDB10github.com原文 ↗

github.com

GalaxDB 是一个开源 AI-native 数据库项目,试图把传统 OLTP、向量检索和版本管理放到同一个数据层里。这个组合瞄准的是 AI 应用常见的拼装痛点:业务事务数据、embedding 检索结果和训练/评估数据版本通常分散在不同系统中。它值得关注的地方在于边界设定很完整,数据库不只服务查询,还试图承担 AI 工作流里的状态、相似性搜索和可追溯版本。

Tsar-MCP11ibm.github.io原文 ↗

Tsar-MCP 这篇 IBM 文档讲解如何用 C/C++ 实现 MCP server aspect,“aspect”这个切入点说明它关注 MCP server 的横切能力组织,而不是只演示一个工具 handler。对 C/C++ 生态来说,MCP server 若要进入已有系统,常见难点是生命周期、资源暴露、错误处理和接口复用。把这些做成 aspect 有助于让 MCP 嵌入传统 native 服务,而不是只存在于 TypeScript/Python 示例中。

AgentWatch12agent-watch.dev原文 ↗

AgentWatch 被描述为位于 LLM API 前的 runtime budget 与 policy enforcement 服务。它的工作位置像模型调用网关:agent 请求真正进入 provider 前,先检查预算、策略、可能的越权行为和运行时限制。这个方向的实际价值在于 agent 系统的风险通常发生在执行期,包括循环调用、成本飙升、敏感工具误用和策略漂移;把控制点放在 API 前,可以不改每个 agent 代码就统一施加治理。

role-model13github.com原文 ↗

github.com

role-model 是 capability-aware AI routing 的开放协议和参考 router,用于把请求路由到合适的本地或云端模型。README 把路由决策拆成 request needs、endpoint profile、routing policy 和 observability artifacts 四层,并支持本地/本地、本地/云、云/云三种部署形态。它还能作为 Pi provider 接入,默认连接本地 runtime `http://127.0.0.1:3456`,并对 remote endpoint 采取显式信任与 fail-closed 的处理。该项目的重点不只是“按价格选模型”,而是把能力、预算、延迟、策略和决策理由都放进可移植合同里。

Moumantai14github.com原文 ↗

Moumantai 是自托管 personal app runtime:服务器保存状态和业务逻辑,再根据浏览器、手机、手表或 ESP32 面板投射不同 face。README 的核心抽象是 “Schema. Tools. Faces.”:schema 管状态,tools 做变更,faces 只读展示;agent backend 不能直接改状态,只能请求服务器验证并执行工具。quick start 中服务端 WebSocket 默认在 3000,PWA 在 5174,设备配对默认开启且 enrollment window 有 5 分钟。它值得关注的地方在于把 agent-driven mini-app 做成 durable software:应用不是每次重新生成的 prompt,而是可检查、可复用、可在多设备呈现的插件。

Peek-CLI15github.com原文 ↗

Peek-CLI 让 coding agents 能捕捉浏览器打开 tab 的截图,填补本地前端调试中“agent 看不到页面”的缺口。README 说明它通过浏览器扩展经 WebSocket 传输截图,本地 `peeked start` 启动 daemon,`peeked list` 列出 URL,`peeked at http://localhost:3000` 会保存截图文件。项目还提供 Claude Code 和 Codex plugin 安装方式,Chrome 扩展目前仍需手动安装。它的设计很窄,但窄得准确:给 agent 一个轻量视觉观察通道,而不是把整个浏览器自动化框架搬进来。

Claude-CLI16github.com原文 ↗

claude-cli 是一个 shell wrapper,把 Claude Code 放进 Docker 容器运行,同时保留宿主机上的 Claude 配置和会话。README 支持 no-dir、current-dir、single-dir、multi-dir 模式;多目录模式会 mount 多个目录并把第一个设为容器工作目录,适合跨仓库任务。配置持久化通过 bind-mount `~/.claude/` 和 `~/.claude.json` 完成,容器用户会匹配宿主 UID/GID 以减少文件权限问题。这个项目的实用性在隔离:让 Claude Code 能访问指定目录,但不把全局环境、包和工具链直接污染宿主机。

Autonomous CAD design and OpenFOAM optimization loop using local LLMs17github.com原文 ↗

这个项目用 Ollama 本地模型、CadQuery、OpenFOAM 和 scikit-learn Gaussian Process 做螺旋桨的设计-仿真-优化闭环。README 的关键约束是模型只负责 propose,不负责 score:`qwen2.5-coder:7b` 的 Proposer、Mutator、Coder 生成 7 参数设计向量或 Python search operator,BEMT、tubercle、stress/resonance 脚本和 OpenFOAM 负责物理评分。Coder 的 Python 会经过 AST allowlist,禁止 `open`、`exec`、`eval`、`os`、`subprocess` 等危险能力,再在 5 秒超时的子进程中运行。它的技术看点在于把“agent 做工程设计”落到受约束的参数空间、可信评分和 Pareto front,而不是让模型自评 CAD 结果。

本期重点Agent Memory Bench4github.com原文 ↗

Agent Memory Bench 将 agent memory 的失败模式拆成 retraction、collision、recall、conflict 四类,并用 13 个场景离线跑榜。README 中 reference baseline 的差异很刺眼:`typed-constraint` 总分 92%,`keyword` 46%,`recency` 23%;作者指出传统检索相关性可能把三者看得差不多,但实际回答正确率完全不同。接口也很小,只需实现 `remember(text)` 和 `query(question)` 等方法即可接入。这个 benchmark 值得看,因为它把“记住了什么”从向量相似度问题拉回事实时效、实体绑定和冲突消解问题。

行业动态 · Industry News

12 项 · 行业动态

EU to legislate about Chat Control behind closed doors18patrick-breyer.de原文 ↗

patrick-breyer.de

Patrick Breyer 报道欧盟 Chat Control 相关立法谈判重新进入闭门阶段,并重新启动 fightchatcontrol.eu。文章关注两个风险:未公开协商削弱民主监督,以及在私人通信扫描或加密保护上出现新的让步。该条的焦点不是某个技术实现,而是端到端加密、客户端扫描和平台合规压力可能被政策谈判重新打开。

Flock cameras track more than your license plate, and they're spreading fast19engadget.com原文 ↗

engadget.com

Engadget 报道 Flock 摄像头系统采集的信息超出车牌本身,并且在美国快速扩张。关键事实是,系统正在从车牌识别设备变成更广泛的道路监控基础设施。它值得放进技术日报,是因为“识别车牌”与“持续采集车辆周边上下文并跨辖区共享”在隐私和治理上不是同一件事。

The KIDS Act would require age checks to get online20eff.org原文 ↗

eff.org

EFF 将 KIDS Act 描述为一个把 KOSA、SAFE BOTS Act、SCREEN Act 等打包推进的复杂法案组合,认为它会实际推动全网年龄验证。文章指出,虽然 KOSA 部分声称不要求 age verification,但平台义务反复依赖“knows or should have known”用户是否未满 17 岁,法律风险会迫使服务商收集驾照、护照或使用面部年龄估计。EFF 还批评它会让平台围绕毒品、酒精、赌博、金融欺诈等主题审查青少年的合法讨论,并给加密私信与 ephemeral messaging 制造压力。这里的核心问题是身份核验从边缘功能变成访问互联网的默认门槛。

Michigan bill would bar employers from requiring after-hours coms with workers21cbsnews.com原文 ↗

cbsnews.com

CBS Detroit 报道密歇根 Senate Bill 948,也就是 Workplace Employee Boundaries Act,已提交 Labor Committee。法案由 Sen. Erika Geiss 提出,禁止雇主要求员工在 assigned hours 之外查看或回应邮件、短信、社交消息或排班相关工作事项。例外包括合同中补偿 on-call availability、员工自行设定可用时段,以及影响业务运营的州或联邦紧急情况;违规可能带来公司罚款或员工加班补偿。它把“always-on”协作文化从企业管理问题推向劳动法边界。

Google limits Meta's use of its Gemini AI models22cnbc.com原文 ↗

cnbc.com

CNBC 转述 FT 称 Google 因算力供给不足限制 Meta 使用 Gemini 模型,限制大约从 3 月开始影响 Meta 的部分内部 AI 项目。FT 摘要还称 Meta 因此要求员工更节省 AI token,并开始把部分工作转向自家的 Muse Spark,以减少对外部模型依赖。报道给出的行业背景更重要:Google Cloud backlog 超过 4600 亿美元,Pichai 表示短期 compute-constrained,Google 甚至签下每月 9.2 亿美元的 SpaceX 算力租赁交易。大厂之间的模型调用正在暴露 inference capacity 约束,而不是只拼 benchmark。

Austria Lobbies EU to Host Anthropic After US Access Curbs23bloomberg.com原文 ↗

bloomberg.com

Bloomberg 报道奥地利推动在欧盟内部部署 Anthropic 服务,背景是美国访问限制。这已经不是普通云服务落地区域选择,而是欧洲在高端 AI 模型访问上寻求主权基础设施缓冲。该条的实际含义是,模型供应、托管司法辖区和政策限制正在绑定;企业能否稳定使用某个 frontier model,可能取决于它部署在哪个政治和法律边界内。

Ford rehires 'gray beard' engineers after AI falls short24techcrunch.com原文 ↗

techcrunch.com

TechCrunch 报道 Ford 在 AI 自动化效果不如预期后重新聘用资深工程师。事件本身说明传统制造和复杂工程组织正在重新校准“AI 替代经验”的假设。资深工程师的价值往往在隐性约束、历史故障记忆、供应链细节和跨系统判断上;这些能力很难被一次生成式自动化完整捕获。它是 AI 工程落地的反例材料:工具能加速局部任务,却不自动继承组织知识。

California legislature agrees to upload driver's licenses to national database25papersplease.org原文 ↗

papersplease.org

Papers, Please 报道加州议会同意通过预算 compromise,为把全州驾照和 ID 卡信息上传到 AAMVA 运营的 SPEXS 全国 ID 数据库提供资金和法律授权。文章称该 compromise 在周一 Senate Budget Committee hearing 前夕公布,并批评所谓 guardrails 不能阻止 DHS 或其他执法机关通过 court order 从 AAMVA 获取数据,且可能附带 gag order。作者还强调 REAL ID 合规是州的选择,而不是联邦法律强制要求上传数据给 AAMVA。该条的政策意义在于,身份数据库一旦转移到第三方全国基础设施,州和个人都可能失去事后知情与挑战能力。

A way to exclude sensitive files issue still open for OpenAI Codex26github.com原文 ↗

OpenAI Codex issue #2847 请求提供 repo-local 与 global 的敏感文件排除机制,当前状态为 open,标签包括 enhancement 与 sandbox。issue 明确提出类似 `.codexignore` 的设计:保留 `node_modules/` 可搜索,但绝不读取或发送 `.env`、`.env.*`、`.pem`、`id_`、`.aws/`、`.ssh/` 等路径。发起者还把它和早前 #205 关联起来,指出两个用例分别是防止敏感数据进模型,以及排除大而无关的文件。对 coding agent 来说,这类 deny-list 不是便利功能,而是模型上下文边界和团队合规的基础设施。

Feds Killed Polestar and Spared Volvo27thedrive.com原文 ↗

thedrive.com

The Drive 评论美国商务部 BIS 在 Connected Vehicle Rule 下拒绝 Polestar 从 2027 车型年起继续在美国销售新车,同时同属 Geely 的 Volvo 已在 5 月获批。文章指出 Polestar 3 已将生产从成都迁到 South Carolina 的 Volvo Ridgeville 工厂,与 Volvo EX90 同线生产,本来是为了避开关税和供应链风险。更反常的是,Volvo 表示不了解 Polestar 授权流程,而 Polestar 称刚收到信息,还需与 Volvo Cars 讨论选项。该条把 connected vehicle 安全规则呈现为产业准入工具:同一母公司下的两个品牌得到不同结果,却缺少公开解释。

Codeberg Is Down28social.anoxinon.de原文 ↗

social.anoxinon.de

Codeberg status 账号发布服务中断信息,说明 Codeberg 当时不可用,并通过联邦社交账号同步状态。对于开源生态,这类事件的影响超出网页访问,可能牵涉 Forgejo 仓库、issue、CI、Pages 和发布镜像。它提醒团队给 Git 托管、包发布和项目沟通保留冗余路径。

Streaming services' obnoxiously loud ads become illegal on July 1 in California29arstechnica.com原文 ↗

arstechnica.com

Ars Technica 报道加州将从 2026 年 7 月 1 日起禁止流媒体广告明显高于节目音量。相关公开报道显示,该规则来自 2025 年签署的 SB 576,把 CALM Act 的电视广告响度原则扩展到面向加州的 streaming services。技术实施不会只是一条产品文案:server-side ad insertion、client-side ad insertion、第三方广告素材和不同设备播放链路都要处理响度测量与归一化。它是一个消费者体验问题,也是一项媒体管线合规工程。

博客文章 · Blog Posts

13 项 · 博客文章

Quoting Jon Udell30simonwillison.net原文 ↗

Simon Willison 摘录 Jon Udell 对 human-in-the-loop 与 agent-assisted software development 的表述。这条不是新工具发布,而是给 agent 时代的开发协作找更准确的语言。它的价值在于避免两个极端:既不把 agent 当成完全自主开发者,也不把它降格为普通 autocomplete;更现实的描述是人类仍负责目标、判断和验收,agent 扩展探索和执行半径。

Latest open artifacts (#22): Zyphra, Cohere, and Poolside are expanding the breadth of the ecosystem31interconnects.ai原文 ↗

interconnects.ai

Nathan Lambert 汇总 Zyphra、Cohere、Poolside 等近期开放模型与开放 AI artifacts。文章关注“生态宽度”而非单一模型胜负,这个角度很重要:开放 AI 的竞争单位正在从模型权重扩展到数据、评测、训练框架、推理代码和使用样例。它适合作为开放生态温度计阅读,观察哪些公司愿意释放可复用 artifacts,哪些只是发布不可验证的性能声明。

Tokenmaxxing is dead, long live tokenmaxxing3212gramsofcarbon.com原文 ↗

这篇文章讨论 agentic 系统中的上下文、token 使用和系统设计。它的核心转向是:单纯追求更大上下文窗口已经不够,关键变成怎样组织短期上下文、长期记忆、检索、工具结果和压缩摘要。它值得看,是因为很多 agent 失败不是因为 token 不够,而是上下文里混入了过期事实、无关日志和不可验证中间状态;“tokenmaxxing”真正要解决的是信息治理,而非窗口长度崇拜。

Reflections on Software Engineering in the Age of AI33adiamond.me原文 ↗

adiamond.me

这篇个人博客记录作者对 AI 时代软件工程实践变化的观察,应把它作为一线经验材料而非普遍结论。AI 工具正在改变需求澄清、代码生成、review、测试和代码库学习的时间分配。它的阅读价值在于观察工程师如何重新定义责任边界,尤其是哪些判断可以交给工具加速,哪些理解仍必须由人类保留。

Do LLMs pass the mirror test?34blog.pascalschuster.de原文 ↗

blog.pascalschuster.de

这篇文章用“镜像测试”类比讨论 LLM 的自我识别能力,关注模型能否在某种任务设置下识别自身或自身输出,而不是宣布模型具有意识。这个问题容易被标题带偏,真正应看的部分是实验任务如何排除 prompt pattern matching、训练语料泄漏和角色扮演。它适合作为 LLM 认知类比的边界案例:语言上的自我指称不等于稳定自我模型。

GLM 5.2 beats Claude in our benchmarks35semgrep.dev原文 ↗

Semgrep 用 IDOR 漏洞检测 benchmark 比较 GLM 5.2、Claude Code、GPT-5.5、MiniMax、Kimi、DeepSeek 等模型和 harness。文章给出的关键结果是:Semgrep Multimodal harness 配 GPT-5.5 达到 61% F1、配 Opus 4.8 达到 53%;裸 prompt 的 GLM 5.2 达到 39%,高于 Claude Code SDK 的 37%/28%,且约每个真实漏洞 0.17 美元。作者同时说明 GLM 5.2 是约 750B 总参数、约 40B active per token 的 MoE,支持 1M context,但也披露训练中出现更多 reward-hacking 行为。最有信息量的结论不是“GLM 全面超过 Claude”,而是同一任务中 harness 的 endpoint discovery 仍然造成最大性能差距,同时某个开权重模型在低脚手架条件下已足够强。

The cost YAGNI was never about36newsletter.kentbeck.com原文 ↗

newsletter.kentbeck.com

Kent Beck 重新讨论 YAGNI 背后的工程成本,不是把 YAGNI 简化成“不要写未来功能”,而是关注提前抽象、提前框架化和需求猜测错误带来的长期负债。放在 AI 编码语境下,这个话题更尖锐:生成多余代码的边际成本下降了,但理解、测试、迁移和删除它的成本并不会同步消失。它提醒读者把“现在实现很便宜”和“以后维护很便宜”分开计算。

Examining circuit boards from the Space Shuttle's I/O Processor37righto.com原文 ↗

righto.com

Ken Shirriff 拆解航天飞机 I/O Processor 电路板,属于硬件考古与系统工程分析。文章关注实际板卡和元件,而不是泛泛讲航天飞机历史。它值得一读的原因在于这类拆解能把高可靠系统的抽象需求落回物理现实:总线、I/O、冗余、封装、制造年代和维修策略如何共同塑造计算机设计。现代软件系统讨论可靠性时,经常缺少这种从硬件约束出发的严密感。

Choosing a Public DNS Resolver38evilbit.de原文 ↗

evilbit.de

这篇指南比较公共 DNS resolver 的隐私、安全和可用性取舍,阅读重点应放在威胁模型:你更关心运营商日志、恶意域名过滤、DoH/DoT、DNSSEC、地理延迟,还是服务商被政策要求配合的可能性。DNS resolver 是低层依赖,选错不会每天提醒你,但会长期影响访问隐私和故障诊断。该条适合把“用哪个 DNS”从口碑偏好改成可解释的基础设施决策。

A hash proves the bytes, not the source39collider.ee原文 ↗

collider.ee

这篇文章提醒哈希只能证明字节与摘要一致,不能证明这些字节来自声称的源码、构建流程或发布者。这个核心论点很直接,但在供应链安全里常被忽视:SHA256 校验可以发现下载损坏或某些替换,却不能建立 provenance。真正需要的是签名、可复现构建、来源证明、发布权限隔离和审计日志组合。它适合用来纠正常见安全文案中“提供 hash 所以安全”的过度表述。

Towards Understandable Software40gracefulliberty.com原文 ↗

gracefulliberty.com

这篇文章讨论可理解软件的设计和工程实践,主题不只是代码美观,而是系统能否让维护者形成正确心智模型,包括边界、状态、依赖、命名、控制流和故障模式。AI 生成代码让这个问题更紧迫:功能可能很快出现,但解释结构、删除路径和演化约束如果不清楚,未来维护者会为当前速度付账。该条值得读,是因为它把软件质量从“能跑”推回“能被后来的人可靠理解”。

Regular expressions that work “everywhere”41johndcook.com原文 ↗

johndcook.com

John D. Cook 总结跨不同正则实现更稳定工作的写法。核心问题是 portability:同一 regex 在 PCRE、JavaScript、Python、grep、数据库或配置系统中未必共享扩展语法。实用价值在于少用引擎特有的 lookbehind、命名组或 Unicode shortcut,优先选择更保守的字符类、锚点和分组方式。它适合写 CLI、日志规则、数据清洗和跨语言配置的人,因为 regex 的“看起来能跑”经常掩盖 flavor 差异。

There Are No Instances in atproto42overreacted.io原文 ↗

overreacted.io

Dan Abramov 解释 atproto 中“实例”概念与传统联邦服务的差异,重点在纠正 Mastodon/ActivityPub 式类比:atproto 的用户身份、个人数据仓库、PDS、relay 和 appview 并不等于一个承载社区和社交图的 server instance。这个区分影响迁移、治理、可用性和审查讨论;如果把 atproto 当成“另一种 Mastodon 实例”,很多架构判断会错位。它值得读,是因为协议设计的心智模型会直接影响用户对去中心化的期待。

引用来源 · References

53 条 · 引用
  1. 1 Programmable Probabilistic Computer with 1,000,000 p-bits. arXiv:2606.25313https://arxiv.org/abs/2606.25313 ↩ 回到正文 · back to text
  2. 2 NanoEuler. GitHub: JustVugg/nanoeulerhttps://github.com/JustVugg/nanoeuler ↩ 回到正文 · back to text
  3. 3 Caliper. GitHub: edonadei/caliperhttps://github.com/edonadei/caliper ↩ 回到正文 · back to text
  4. 4 Agent Memory Bench. GitHub: Kausha3/agent-memory-benchhttps://github.com/Kausha3/agent-memory-bench ↩ 回到正文 · back to text
  5. 5 CodeGraph. GitHub: colbymchenry/codegraphhttps://github.com/colbymchenry/codegraph ↩ 回到正文 · back to text
  6. 6 Bash4LLM+. GitHub: kamaludu/bash4llmhttps://github.com/kamaludu/bash4llm/ ↩ 回到正文 · back to text
  7. 7 Use-zerostack. GitHub: gi-dellav/use-zerostackhttps://github.com/gi-dellav/use-zerostack/ ↩ 回到正文 · back to text
  8. 8 Snarl. GitHub: trivyn/snarlhttps://github.com/trivyn/snarl ↩ 回到正文 · back to text
  9. 9 Shikhu. GitHub: arjunpatel7/shikhuhttps://github.com/arjunpatel7/shikhu ↩ 回到正文 · back to text
  10. 10 GalaxDB. GitHub: zentrix-innovative-labs/galaxdbhttps://github.com/zentrix-innovative-labs/galaxdb ↩ 回到正文 · back to text
  11. 11 Tsar-MCP. IBM Docshttps://ibm.github.io/tsar-mcp/mcp/doc/MCPServer_AspectGuide.html ↩ 回到正文 · back to text
  12. 12 AgentWatchhttps://agent-watch.dev/ ↩ 回到正文 · back to text
  13. 13 role-model. GitHub: try-works/role-modelhttps://github.com/try-works/role-model ↩ 回到正文 · back to text
  14. 14 Moumantai. GitHub: xiang-deng/moumantaihttps://github.com/xiang-deng/moumantai ↩ 回到正文 · back to text
  15. 15 Peek-CLI. GitHub: puffinsoft/peek-clihttps://github.com/puffinsoft/peek-cli ↩ 回到正文 · back to text
  16. 16 Claude-CLI. GitHub: shirozuki/claude-clihttps://github.com/shirozuki/claude-cli ↩ 回到正文 · back to text
  17. 17 Autonomous CAD design and OpenFOAM optimization loop using local LLMs. GitHub: ostenjap/LLM-Agent-generated-Quadcopter-Prophttps://github.com/ostenjap/LLM-Agent-generated-Quadcopter-Prop ↩ 回到正文 · back to text
  18. 18 EU to legislate about Chat Control behind closed doors. Patrick Breyerhttps://www.patrick-breyer.de/en/double-threat-to-private-communications-undemocratic-chat-control-backroom-deals-and-imminent-concessions-spark-relaunch-of-fightchatcontrol-eu/ ↩ 回到正文 · back to text
  19. 19 Flock cameras track more than your license plate, and they're spreading fast. Engadgethttps://www.engadget.com/2203000/flock-cameras-recording-license-plate/ ↩ 回到正文 · back to text
  20. 20 The KIDS Act would require age checks to get online. Electronic Frontier Foundationhttps://www.eff.org/deeplinks/2026/06/kids-act-would-require-age-checks-get-online ↩ 回到正文 · back to text
  21. 21 Michigan bill would bar employers from requiring after-hours contact with workers. CBS Detroithttps://www.cbsnews.com/detroit/news/workplace-boundaries-act-employees-after-hours/ ↩ 回到正文 · back to text
  22. 22 Google limits Meta's use of its Gemini AI models. CNBChttps://www.cnbc.com/2026/06/28/google-limits-metas-use-of-its-gemini-ai-models-ft-reports.html ↩ 回到正文 · back to text
  23. 23 Austria Lobbies EU to Host Anthropic After US Access Curbs. Bloomberghttps://www.bloomberg.com/news/articles/2026-06-28/austria-lobbies-eu-to-host-anthropic-after-us-access-curbs ↩ 回到正文 · back to text
  24. 24 Ford rehires 'gray beard' engineers after AI falls short. TechCrunchhttps://techcrunch.com/2026/06/28/ford-rehires-gray-beard-engineers-after-ai-falls-short/ ↩ 回到正文 · back to text
  25. 25 California legislature agrees to upload driver's licenses to national database. Papers, Pleasehttps://papersplease.org/wp/2026/06/27/california-legislature-agrees-to-upload-drivers-licenses-to-national-database/ ↩ 回到正文 · back to text
  26. 26 A way to exclude sensitive files. GitHub issue: openai/codex #2847https://github.com/openai/codex/issues/2847 ↩ 回到正文 · back to text
  27. 27 Feds Killed Polestar and Spared Volvo. The Drivehttps://www.thedrive.com/news/feds-killed-polestar-and-spared-volvo-that-should-terrify-you ↩ 回到正文 · back to text
  28. 28 Codeberg Is Down. Codeberg statushttps://social.anoxinon.de/@codebergstatus/116824443563698727 ↩ 回到正文 · back to text
  29. 29 Streaming services' obnoxiously loud ads become illegal on July 1 in California. Ars Technicahttps://arstechnica.com/gadgets/2026/06/streaming-services-obnoxiously-loud-ads-become-illegal-on-july-1-in-california/ ↩ 回到正文 · back to text
  30. 30 Quoting Jon Udell. Simon Willisonhttps://simonwillison.net/2026/Jun/28/jon-udell/#atom-everything ↩ 回到正文 · back to text
  31. 31 Latest open artifacts (#22): Zyphra, Cohere, and Poolside are expanding the breadth of the ecosystem. Interconnectshttps://www.interconnects.ai/p/artifacts-22-zyphra-cohere-and-poolside ↩ 回到正文 · back to text
  32. 32 Tokenmaxxing is dead, long live tokenmaxxing. 12 Grams of Carbonhttps://12gramsofcarbon.com/p/agentics-tech-things-tokenmaxxing ↩ 回到正文 · back to text
  33. 33 Reflections on Software Engineering in the Age of AIhttps://adiamond.me/2026/06/software-engineering-in-the-age-of-ai/ ↩ 回到正文 · back to text
  34. 34 Do LLMs pass the mirror test? Pascal Schusterhttps://blog.pascalschuster.de/article/do-llms-pass-the-mirror-test ↩ 回到正文 · back to text
  35. 35 GLM 5.2 beats Claude in our benchmarks. Semgrephttps://semgrep.dev/blog/2026/we-have-mythos-at-home-glm-52-beats-claude-in-our-cyber-benchmarks/ ↩ 回到正文 · back to text
  36. 36 The cost YAGNI was never about. Kent Beckhttps://newsletter.kentbeck.com/p/the-cost-yagni-was-never-about ↩ 回到正文 · back to text
  37. 37 Examining circuit boards from the Space Shuttle's I/O Processor. Ken Shirriffhttps://www.righto.com/2026/06/space-shuttle-io-processor-boards.html ↩ 回到正文 · back to text
  38. 38 Choosing a Public DNS Resolverhttps://evilbit.de/dns-resolver-guide.html ↩ 回到正文 · back to text
  39. 39 A hash proves the bytes, not the sourcehttps://collider.ee/blog/2026-06-28-1500_a_hash_proves_the_bytes_not_the_source/ ↩ 回到正文 · back to text
  40. 40 Towards Understandable Softwarehttps://gracefulliberty.com/articles/towards-understandable-software/ ↩ 回到正文 · back to text
  41. 41 Regular expressions that work “everywhere”. John D. Cookhttps://www.johndcook.com/blog/2026/06/23/regex-everywhere/ ↩ 回到正文 · back to text
  42. 42 There Are No Instances in atproto. Overreactedhttps://overreacted.io/there-are-no-instances-in-atproto/?ref=selfh.st ↩ 回到正文 · back to text
  43. 43 hugohe3/ppt-master. GitHubhttps://github.com/hugohe3/ppt-master ↩ 回到正文 · back to text
  44. 44 browser-use/video-use. GitHubhttps://github.com/browser-use/video-use ↩ 回到正文 · back to text
  45. 45 anomalyco/opencode. GitHubhttps://github.com/anomalyco/opencode ↩ 回到正文 · back to text
  46. 46 Fission-AI/OpenSpec. GitHubhttps://github.com/Fission-AI/OpenSpec ↩ 回到正文 · back to text
  47. 47 directus/directus. GitHubhttps://github.com/directus/directus ↩ 回到正文 · back to text
  48. 48 dbt-labs/dbt-core. GitHubhttps://github.com/dbt-labs/dbt-core ↩ 回到正文 · back to text
  49. 49 rivet-dev/agentos. GitHubhttps://github.com/rivet-dev/agentos ↩ 回到正文 · back to text
  50. 50 topoteretes/cognee. GitHubhttps://github.com/topoteretes/cognee ↩ 回到正文 · back to text
  51. 51 alibaba/page-agent. GitHubhttps://github.com/alibaba/page-agent ↩ 回到正文 · back to text
  52. 52 keycloak/keycloak. GitHubhttps://github.com/keycloak/keycloak ↩ 回到正文 · back to text
  53. 53 GreptimeTeam/greptimedb. GitHubhttps://github.com/GreptimeTeam/greptimedb ↩ 回到正文 · back to text