每日 Harness 开源 · Source
全部刊期 · All issues

每日 Harness

2026-07-15 · Wednesday, July 15, 2026

智能体的证据边界

视图 · View

今日重点 · Today's Highlights

MemStitch4 - 在 vLLM/PagedAttention 思路上做 KV cache 级 context bridging,README 示例把共享长文档场景的 TTFT 从 1200ms 压到 48ms。

全文 ↓

Pulsys5 - 面向 Hugging Face 的自托管 pull-through cache,用 io_uring 和 sendfile 这类系统调用优化模型文件本地读取路径。

全文 ↓

论文 · Papers

12 项 · 论文

Format Sensitivity Index: Token-Controlled Prompt Wrapper Robustness and Schema Compliance in LLM Benchmarking6arxiv.org原文 ↗

评测方法基准其他垂直

这篇论文把 prompt wrapper 对 benchmark 的扰动量化为 FSI,并用 PSI 衡量输出是否还能被 schema 解析,而不是只报告模型分数。实验覆盖 14 个开源 LLM、25 种 wrapper 和 6 个 benchmark,显示 bias message、JSON schema、Markdown 等外层格式会改变 accuracy/F1 与 parseability。它值得放进评测流程讨论,因为它把“提示模板工程”从隐性变量变成了可审计的实验条件。

Faithful, Not Corrective: Message-Format Effects in Multi-Hop Agent Relays Are Tier-Dependent7arxiv.org原文 ↗

论文研究多跳 agent relay 里消息格式如何影响信息传递,结论是格式能提高低层遵循度,却不能自动修复上游语义错误。作者比较 1 到 3 跳 relay,并观察 ReAct 与 plan-and-problem 等格式在不同层级的差异;PaP 的结构化输出更稳定,但任务正确性仍随跳数下降。它的实际启发是,给中间 agent 换输出格式不能替代端到端事实校验。

本期重点What Context Does a Coding Agent Actually Need to Act?1arxiv.org原文 ↗

论文把 coding agent 的上下文需求分成定位工作点与执行编辑两个阶段,并对 SWE-bench Verified 的 96 个任务做人工审计。一个关键数字是 49% 的任务需要语义相关但词面不相似的外部信息;在约 10K token oracle 编辑上下文下,Claude Sonnet 4 的理论解决率上限是 70.2%,而现有检索方法仍低 43.8 个百分点。这说明“长上下文”并不等于“拿到了可编辑证据”,检索目标需要从文件定位细化到变更所需约束。

Agentic Context Learning with Self-Discovered Specification8arxiv.org原文 ↗

这篇论文讨论 inference-time context learning 中的一个更难问题:模型要先从上下文里发现隐含规格,再把规格应用到新任务。方法围绕 self-discovered specification,让 agent 抽取格式约束、操作规则和任务边界,再进入执行阶段。它的看点在于把 few-shot/context learning 从“看例子模仿”推进到“从上下文重建任务规范”,这对企业流程、表单和工具协议类 agent 很接近真实场景。

Who&When Pro: Can LLMs Really Attribute Failures in AI Agents?9arxiv.org原文 ↗

论文提出 Who&When Pro,用来评估 LLM 是否能判断 agent 失败由谁造成、发生在哪一步。benchmark 面向多轮 agent 轨迹和多种失败原因,要求模型同时处理责任归因与时间定位;摘要强调当前 LLM 在长交互中明显不如人工标注稳定。它把“agent 出错了”拆成可操作的诊断问题,比只看最终成功/失败更适合调试复杂工作流。

本期重点AgentAbstain: Do LLM Agents Know When Not to Act?2arxiv.org原文 ↗

AgentAbstain 把 abstention 作为 agent 行为评测的核心,而不是把所有场景都压成完成任务。论文覆盖不确定、约束冲突、不可完成与工具失败等条件,观察模型是否会停止、澄清或拒绝继续行动。这个方向重要在于它评估的是行动边界:一个能完成任务的 agent,如果在错误前提下仍持续调用工具,实际系统风险会被传统 success rate 低估。

Dynamic Agent Skills: A Lifecycle Survey and Taxonomy of Evolving Skill Libraries10arxiv.org原文 ↗

这篇综述把 skill library 看成会持续演化的运行时资产,而不是一组静态 prompt 或脚本。文章按生命周期整理技能发现、表示、检索、执行、更新与治理机制,并比较代码技能、工具技能和程序化记忆等形态。它的价值在于给“agent 会积累能力”这件事建立词汇表,同时指出版本控制、评测和退役机制仍缺统一做法。

ANCHOR: Automated Alignment Auditing for CLI Agents on Real-World Harm11arxiv.org原文 ↗

ANCHOR 针对 CLI agents 做自动化 alignment auditing,把真实危害任务放进可控命令行环境中观察 agent 行动。它评估的不是聊天拒答,而是代理是否会执行不该执行的文件、网络或系统操作。这个框架的意义在于把安全审计落到可复现的工具轨迹,适合发现“文字上安全、行动上越界”的问题。

本期重点GRASP: GRanularity-Aware Search Policy for Agentic RAG3arxiv.org原文 ↗

GRASP 处理 Agentic RAG 中常见的三连决策:什么时候检索、用哪种检索、返回多粗粒度的上下文。论文把这些选择合成一个 granularity-aware search policy,让 agent 在文档、段落和更细片段之间按任务状态切换。它的技术看点不是再堆一个 retriever,而是把检索成本、证据完整性和上下文污染放进同一控制策略。

MemDecay: Region-Aware KV Cache Eviction for Efficient LLM Agent Inference12arxiv.org原文 ↗

上下文工程系统·基础设施

MemDecay 提出 region-aware KV cache eviction,按上下文区域管理长轨迹推理中的缓存保留。它区分系统指令、用户目标、工具输出、历史推理和检索材料等不同区域,避免把所有 token 当作同等可驱逐对象。这个设计贴近 agent 推理的真实结构:有些早期约束很短却关键,有些近期工具日志很长却可能只需短期保留。

Agentic-DPO: From Imitation to Agentic Policy Optimization on Expert Trajectories13arxiv.org原文 ↗

论文把 DPO 扩展到多轮 agent trajectory,不再只让模型模仿专家下一步动作。Agentic-DPO 将行动选择、工具调用路径和最终结果纳入偏好优化,目标是学习哪条轨迹整体更优。它适合放在 agent training 脉络里看,因为行为克隆容易复制表面步骤,而轨迹级偏好更接近实际执行质量。

AgentCheck: A Reproduce-Intervene-Mitigate Workbench for LLM Agents over MCP14arxiv.org原文 ↗

AgentCheck 是一个基于 MCP 的 workbench,用于复现 agent 故障、注入干预并验证缓解措施。它把工具返回异常、状态污染和代理决策错误做成可重复轨迹,避免排查只停留在一次性日志阅读。它的看点是把 MCP 生态里的 agent 调试过程工具化:先复现,再介入,最后用同一场景确认修复有效。

开源 / 项目 · Projects

12 项 · 开源 / 项目

Alluvia15github.com原文 ↗

Alluvia 做的是本地 AI 会话历史挖掘,目标来源包括 Claude Code、Cursor 和 ChatGPT。项目把分散在不同工具里的提示、代码讨论和模型回复索引到本机,便于跨工具找回旧上下文。它的现实意义在于,AI coding 的知识资产正在沉淀在聊天记录里,而这些记录通常比普通代码搜索更敏感。

llm.mojo16github.com原文 ↗

github.com

llm.mojo 将 llm.c 的训练实现移植到 Mojo,并加入 Metal kernels,面向 Apple GPU/MPS 路径做实验。HN 摘要给出的性能点是相对 PyTorch MPS 快 1.72x,项目重点是小型 GPT 训练栈而不是通用推理框架。它适合关注 Mojo、Metal 和轻量训练内核的人读,因为这里的工程问题集中在内存布局、kernel 和训练循环上。

WebMotion17webmotion.superhq.ai原文 ↗

webmotion.superhq.ai

WebMotion 是浏览器原生视频合成库,把屏幕内容定义为当前帧的纯函数。这样渲染第 N 帧必然得到确定结果,所以时间线 seek 与导出都可以保持 frame-accurate,并且不需要服务器端渲染。它的架构看点是把视频编辑问题写成可重放的前端函数系统,而不是围绕录屏或状态累积做导出。

Pullrun18github.com原文 ↗

github.com

Pullrun 试图让同一个 OCI image 可以作为 container、Firecracker microVM 或 Apple VM 运行。它的贡献不是新镜像格式,而是给隔离等级不同的运行时提供统一入口,减少开发和测试阶段的环境分叉。对于需要在速度、隔离和本机虚拟化之间切换的工具链,这类抽象能让镜像成为更稳定的交付单位。

SirixDB19github.com原文 ↗

github.com

SirixDB 是支持 bitemporal JSON/XML 的 append-only 数据库,强调完整历史保留和按事务时间、有效时间查询。README 的关键机制是 sub-page versioning:变更不必复制整页,从而降低版本化文档的存储放大。它适合审计、配置、知识库和法规文档这类“当前值不够,历史如何变化也重要”的数据。

本期重点Pulsys5github.com原文 ↗

github.com

Pulsys 是 Hugging Face pull-through cache,放在团队或集群与外部模型仓库之间。README 强调 Linux io_uring 与 macOS sendfile,用系统级低拷贝路径提升本地缓存读取吞吐。它的工程价值在于把模型文件分发从临时脚本变成可控基础设施,尤其适合多节点反复拉同一批权重和数据集的场景。

IntentGuard20github.com原文 ↗

IntentGuard 检查 PR 是否虽然通过测试但偏离 ticket 意图。它把 issue 或需求描述与 PR diff 一起审阅,尝试发现功能方向、约束或边界条件实现错位的问题。这个项目补的是 CI 的语义盲区:测试能证明某些行为存在,却很难证明开发者实现的是正确需求。

Rejourney21github.com原文 ↗

github.com

Rejourney 是开源 session recording 与 revenue leakage 分析项目。它从真实 Web 和移动用户路径里寻找导致收入流失的行为片段,把漏斗分析从聚合转化率推进到可回放的具体操作。它更像产品分析与调试工具的结合体,适合定位注册、结账、订阅和升级流程中的摩擦点。

Context Warp Drive22github.com原文 ↗

上下文工程其他垂直

Context Warp Drive 做确定性 context compaction,明确不调用 LLM 生成摘要。它用规则化方式裁剪、保留和重排 agent 上下文,以降低 token 占用并避免总结模型引入遗漏或改写。这个项目的亮点是可解释性:压缩结果来自确定规则,调试时不必再追一个摘要模型是否说错。

RavenGate23gate.ravenlabs.studio原文 ↗

RavenGate 是 LLM gateway,重点能力是在 SSE chunk 边界上做 PII redaction。流式响应里敏感字段可能被拆成相邻 chunk,如果只逐块扫描,邮箱、手机号或账号片段会漏过脱敏逻辑。它抓住的是 LLM gateway 的一个底层细节:安全过滤必须理解流协议,而不是只处理完整字符串。

Kmux24github.com原文 ↗

Kmux 是面向 AI coding agents 的并行 terminal workspace。它把多个 agent 会话放进可管理的终端工作区,便于同时跑不同实现路线、查看输出和比较结果。这个项目反映了一个新工作流:开发者不只是和一个 agent 对话,而是在调度多个并发候选实现。

The MCP Census25mcpcensus.pages.dev原文 ↗

协议与互操作基准系统·基础设施

The MCP Census 对 MCP server 生态做报告和索引,digest 给出的规模是 15,382 个 servers。它做 health check,并把可用性、元数据和发现问题集中呈现。这个项目提供的是生态基础数据:MCP 的热度需要和实际可连接、可维护的服务数量分开看。

行业动态 · Industry News

9 项 · 行业动态

S&P downgrades Oracle to BBB-26heise.de原文 ↗

heise.de

Heise/HN 条目报道 S&P Global 将 Oracle 信用评级从 BBB 下调到 BBB-,距离 junk level 只差一级。对于 AI 基础设施周期,这个事实比单个评级动作更有指示性:云和模型相关资本开支正在让传统软件公司承担更重的债务与数据中心资产压力。市场会继续把“AI 增长故事”和“融资成本上升”放在同一张资产负债表上评估。

IBM Stock has worst day27cnn.com原文 ↗

cnn.com

CNN 条目称 IBM 股价出现其历史上最差单日表现。digest 没有给出可核验跌幅,因此这里只保留核心事实:投资者对 IBM 当日信息做出了极端负面反应。它进入技术日报的原因在于,企业科技公司现在同时被按传统利润质量、云增长和 AI 可信叙事定价。

New York becomes the first state to impose a data center moratorium28reuters.com原文 ↗

reuters.com

Reuters 条目报道纽约成为美国首个对数据中心实施 moratorium 的州。标题本身给出关键政策事实:监管对象是 data center,工具是暂停或限制扩张。AI 算力建设因此不再只是采购 GPU 和签电力合同,还会被地方电网、土地使用和环境治理约束重塑。

European “age verification” app forcing everyone to use Android or iOS29github.com原文 ↗

github.com

这条 GitHub discussion 围绕欧盟数字身份钱包 age verification 技术规范,争议点是实现方案是否把用户绑定到 Android 或 iOS。问题不只是一个 app 的平台选择,而是公共合规能力是否必须通过两大移动生态访问。若桌面、Linux 或无智能机用户缺少等价路径,年龄验证就会变成事实上的平台强制。

OpenAI mandates hardware-backed passkeys for Trusted Access Cyber members30yubico.com原文 ↗

yubico.com

Yubico 文章称 OpenAI Trusted Access Cyber 成员登录 ChatGPT 账户需要 hardware-backed passkeys。这里的关键是把高风险账户认证从密码、短信或普通二次验证推进到硬件支持的 FIDO/passkey 模式。对安全团队而言,这类要求把“账号是攻击面”具体落实到了认证器、设备绑定和抗钓鱼能力。

Germany set to restrict its Freedom of Information Act31dw.com原文 ↗

dw.com

DW 条目报道德国计划限制 Freedom of Information Act。digest 没列出具体修法条文,因此正文只采用可确认的方向:信息自由制度可能收窄,媒体调查、公民查询和公共数据可得性都会受到影响。对数字政府和公共数据使用者来说,法律接口的变化会直接影响数据抓取、归档和问责工作。

Samsung Health app threatens data deletion if users opt out AI training32neow.in原文 ↗

neow.in

Neowin 条目报道 Samsung Health 在用户拒绝 AI training 时显示数据删除警告。健康数据属于高度敏感数据,如果退出训练会触发数据保留威胁,用户同意就很难被视为低压力选择。这个事件的核心不是“是否使用 AI”,而是产品能否把训练授权与基础数据访问清晰拆开。

Former NOAA employees built Climate.us to preserve climate data and resources3319thnews.org原文 ↗

19thnews.org

19th News 条目称前 NOAA 员工建立 Climate.us,用来保存和整理气候数据资源。这个项目的背景是公共数据入口可能迁移、消失或失去上下文说明时,专业人员用独立站点维持资料可达性。它体现的是数据韧性:重要公共知识需要镜像、索引和解释层,而不能只依赖单一官方入口。

How to manage AI investments in the agentic era34openai.com原文 ↗

openai.com

OpenAI 文章讨论企业在 agentic era 管理 AI 投资,核心指标是 useful work per dollar,而不是单次调用成本。文章把 AI ROI 放到工作流层面:选高价值流程,评估效率和质量,再扩展到可重复执行的业务环节。它代表供应商正在把“买模型”叙事转向“运营 agentic 工作流”的管理语言。

博客文章 · Blog Posts

8 项 · 博客文章

lobste.rs is now running on SQLite35simonwillison.net原文 ↗

simonwillison.net

Simon Willison 记录 Lobsters 从 MariaDB 迁移到 SQLite 后的状态。feed 摘要称这个社区站点自 2018 年 8 月起计划迁移,最初目标是 PostgreSQL,去年才转向 SQLite,并在本周末完成迁移。它的看点是一个真实社区站点把 SQLite 作为长期架构选择,而不是只把它当开发环境或小工具数据库。

datasette 1.0a3736simonwillison.net原文 ↗

simonwillison.net

Datasette 1.0a37 是小版本发布,重点包括 permissions system 的性能和文档改进。更有信息量的是回滚一个 cosmetic API change,因为它导致几乎所有现有插件测试套件失败。这个发布说明插件生态的兼容性成本往往藏在“看似无行为变化”的 API 外观里。

Using uvx in GitHub Actions in a cache-friendly way37simonwillison.net原文 ↗

simonwillison.net

这篇 TIL 给出在 GitHub Actions 中更稳定使用 uvx 的 recipe。具体做法是在 workflow 开头设置 `UV_EXCLUDE_NEWER: "2026-07-12"`,并把这个值纳入 Actions cache key,让 `uvx tool-name` 解析到该日期前的最新版本。它解决的是 CI 中工具安装既要新、又要可缓存和可复现的矛盾。

How I use HTMX with Go38alexedwards.net原文 ↗

alexedwards.net

Alex Edwards 介绍在 Go Web 应用中组织 HTMX 请求、模板和服务端处理的实践。digest 的核心是把局部交互保留在 server-rendered 架构内,而不是为了少量动态行为引入大型前端状态系统。它适合与 Go 模板、路由和表单验证一起读,因为 HTMX 的价值往往取决于后端响应片段设计是否干净。

Measuring Input Latency on Linux: X11 vs. Wayland, VRR, and DXVK39marco-nett.de原文 ↗

marco-nett.de

文章用实测数据比较 Linux 上 X11、Wayland、VRR 和 DXVK 组合的输入延迟。它不是抽象讨论显示栈优劣,而是把交互响应放到可测量结果里看。对于游戏、桌面环境和图形驱动调优,这种测量比“某协议更现代”更接近用户实际感知。

The Tower Keeps Rising40lucumr.pocoo.org原文 ↗

lucumr.pocoo.org

Armin Ronacher 讨论软件系统中共享概念、边界和隐含知识如何随项目增长而累积。相关 feed 摘要强调,项目的共同语言由概念含义、不变量、所有权和系统形状组成,分散在文档、代码 review 和团队经验里。它的技术含义是,大型系统的复杂度不只来自代码行数,还来自这些未集中记录的社会化知识。

The Agentic Loop: Three loops in a trench coat41bobbytables.io原文 ↗

这篇文章把 agentic loop 拆成多个控制循环,而不是把 agent 执行看成单次“思考-行动-观察”。这种分解能区分规划循环、工具执行循环和外层监督/治理循环各自承担的责任。它适合用来审视 agent 架构图:很多系统图把所有反馈都画成一个箭头,实际调试时却需要知道是哪一层 loop 失控。

Building Food Metadata with LLM Juries42careersatdoordash.com原文 ↗

careersatdoordash.com

DoorDash 工程博客介绍用 LLM jury、上下文优化和多模态模型构建食品元数据。场景不是泛化聊天,而是把菜单文本、图片和模型判断转成结构化标签、属性或描述。它的工程看点在于“多个模型裁决 + 上下文优化”如何服务具体数据生产流水线,而不是单纯追求一个模型一次答对。

引用来源 · References

50 条 · 引用
  1. 1 What Context Does a Coding Agent Actually Need to Act?. arXiv:2607.09691https://arxiv.org/abs/2607.09691 ↩ 回到正文 · back to text
  2. 2 AgentAbstain: Do LLM Agents Know When Not to Act?. arXiv:2607.10059https://arxiv.org/abs/2607.10059 ↩ 回到正文 · back to text
  3. 3 GRASP: GRanularity-Aware Search Policy for Agentic RAG. arXiv:2607.10463https://arxiv.org/abs/2607.10463 ↩ 回到正文 · back to text
  4. 4 MemStitch. GitHub repositoryhttps://github.com/DaqulaLin/MemStitch ↩ 回到正文 · back to text
  5. 5 Pulsys. GitHub repositoryhttps://github.com/pulsys-io/pulsys ↩ 回到正文 · back to text
  6. 6 Format Sensitivity Index: Token-Controlled Prompt Wrapper Robustness and Schema Compliance in LLM Benchmarking. arXiv:2607.09665https://arxiv.org/abs/2607.09665 ↩ 回到正文 · back to text
  7. 7 Faithful, Not Corrective: Message-Format Effects in Multi-Hop Agent Relays Are Tier-Dependent. arXiv:2607.09678https://arxiv.org/abs/2607.09678 ↩ 回到正文 · back to text
  8. 8 Agentic Context Learning with Self-Discovered Specification. arXiv:2607.09794https://arxiv.org/abs/2607.09794 ↩ 回到正文 · back to text
  9. 9 Who&When Pro: Can LLMs Really Attribute Failures in AI Agents?. arXiv:2607.09996https://arxiv.org/abs/2607.09996 ↩ 回到正文 · back to text
  10. 10 Dynamic Agent Skills: A Lifecycle Survey and Taxonomy of Evolving Skill Libraries. arXiv:2607.10113https://arxiv.org/abs/2607.10113 ↩ 回到正文 · back to text
  11. 11 ANCHOR: Automated Alignment Auditing for CLI Agents on Real-World Harm. arXiv:2607.10455https://arxiv.org/abs/2607.10455 ↩ 回到正文 · back to text
  12. 12 MemDecay: Region-Aware KV Cache Eviction for Efficient LLM Agent Inference. arXiv:2607.10582https://arxiv.org/abs/2607.10582 ↩ 回到正文 · back to text
  13. 13 Agentic-DPO: From Imitation to Agentic Policy Optimization on Expert Trajectories. arXiv:2607.10601https://arxiv.org/abs/2607.10601 ↩ 回到正文 · back to text
  14. 14 AgentCheck: A Reproduce-Intervene-Mitigate Workbench for LLM Agents over MCP. arXiv:2607.11098https://arxiv.org/abs/2607.11098 ↩ 回到正文 · back to text
  15. 15 Alluvia. GitHub repositoryhttps://github.com/dylanp12/alluvia ↩ 回到正文 · back to text
  16. 16 llm.mojo. GitHub repositoryhttps://github.com/ulmentflam/llm.mojo ↩ 回到正文 · back to text
  17. 17 WebMotionhttps://webmotion.superhq.ai/ ↩ 回到正文 · back to text
  18. 18 Pullrun. GitHub repositoryhttps://github.com/pullrun/pullrun ↩ 回到正文 · back to text
  19. 19 SirixDB. GitHub repositoryhttps://github.com/sirixdb/sirix ↩ 回到正文 · back to text
  20. 20 IntentGuard. GitHub repositoryhttps://github.com/derrickchiang1024/intentguard ↩ 回到正文 · back to text
  21. 21 Rejourney. GitHub repositoryhttps://github.com/rejourneyco/rejourney ↩ 回到正文 · back to text
  22. 22 Context Warp Drive. GitHub repositoryhttps://github.com/dogtorjonah/context-warp-drive ↩ 回到正文 · back to text
  23. 23 RavenGatehttps://gate.ravenlabs.studio/ ↩ 回到正文 · back to text
  24. 24 Kmux. GitHub repositoryhttps://github.com/kkd927/kmux ↩ 回到正文 · back to text
  25. 25 The MCP Censushttps://mcpcensus.pages.dev/report ↩ 回到正文 · back to text
  26. 26 S&P downgrades Oracle to BBB-https://www.heise.de/en/news/S-P-downgrades-Oracle-to-BBB-only-one-notch-above-junk-level-11363472.html ↩ 回到正文 · back to text
  27. 27 IBM Stock has worst dayhttps://www.cnn.com/2026/07/14/tech/ibm-stock-worst-day-ever ↩ 回到正文 · back to text
  28. 28 New York becomes the first state to impose a data center moratoriumhttps://www.reuters.com/world/new-york-becomes-first-state-impose-data-center-moratorium-2026-07-14/ ↩ 回到正文 · back to text
  29. 29 European “age verification” app forcing everyone to use Android or iOS. GitHub discussionhttps://github.com/eu-digital-identity-wallet/av-doc-technical-specification/discussions/19 ↩ 回到正文 · back to text
  30. 30 OpenAI mandates hardware-backed passkeys for Trusted Access Cyber membershttps://www.yubico.com/blog/openai-mandates-hardware-backed-passkeys-for-trusted-access-cyber-members-to-log-into-chatgpt-accounts/ ↩ 回到正文 · back to text
  31. 31 Germany set to restrict its Freedom of Information Acthttps://www.dw.com/en/germany-freedom-of-information-act/a-77939695 ↩ 回到正文 · back to text
  32. 32 Samsung Health app threatens data deletion if users opt out AI traininghttps://neow.in/cWsyMTV3 ↩ 回到正文 · back to text
  33. 33 Former NOAA employees built Climate.us to preserve climate data and resourceshttps://19thnews.org/2026/07/noaa-climate-data-website/ ↩ 回到正文 · back to text
  34. 34 How to manage AI investments in the agentic erahttps://openai.com/index/managing-ai-investments-in-agentic-era ↩ 回到正文 · back to text
  35. 35 lobste.rs is now running on SQLitehttps://simonwillison.net/2026/Jul/14/lobsters-sqlite/#atom-everything ↩ 回到正文 · back to text
  36. 36 datasette 1.0a37https://simonwillison.net/2026/Jul/14/datasette/#atom-everything ↩ 回到正文 · back to text
  37. 37 Using uvx in GitHub Actions in a cache-friendly wayhttps://simonwillison.net/2026/Jul/14/uvx-github-actions-cache/#atom-everything ↩ 回到正文 · back to text
  38. 38 How I use HTMX with Gohttps://www.alexedwards.net/blog/how-i-use-htmx-with-go ↩ 回到正文 · back to text
  39. 39 Measuring Input Latency on Linux: X11 vs. Wayland, VRR, and DXVKhttps://marco-nett.de/blog/measuring-input-latency-on-linux-x11-vs-wayland-vrr-dxvk/ ↩ 回到正文 · back to text
  40. 40 The Tower Keeps Risinghttps://lucumr.pocoo.org/2026/7/13/the-tower-keeps-rising/ ↩ 回到正文 · back to text
  41. 41 The Agentic Loop: Three loops in a trench coathttps://www.bobbytables.io/p/the-agentic-loop-three-loops-in-a ↩ 回到正文 · back to text
  42. 42 Building Food Metadata with LLM Jurieshttps://careersatdoordash.com/blog/building-food-metadata-with-llm-juries-context-optimization-multimodal-ai/ ↩ 回到正文 · back to text
  43. 43 argoproj/argo-cd. GitHub repositoryhttps://github.com/argoproj/argo-cd ↩ 回到正文 · back to text
  44. 44 3b1b/manim. GitHub repositoryhttps://github.com/3b1b/manim ↩ 回到正文 · back to text
  45. 45 Vexa-ai/vexa. GitHub repositoryhttps://github.com/Vexa-ai/vexa ↩ 回到正文 · back to text
  46. 46 OpenCut-app/OpenCut. GitHub repositoryhttps://github.com/OpenCut-app/OpenCut ↩ 回到正文 · back to text
  47. 47 Graphify-Labs/graphify. GitHub repositoryhttps://github.com/Graphify-Labs/graphify ↩ 回到正文 · back to text
  48. 48 raine/claude-code-proxy. GitHub repositoryhttps://github.com/raine/claude-code-proxy ↩ 回到正文 · back to text
  49. 49 katanemo/plano. GitHub repositoryhttps://github.com/katanemo/plano ↩ 回到正文 · back to text
  50. 50 simstudioai/sim. GitHub repositoryhttps://github.com/simstudioai/sim ↩ 回到正文 · back to text