每日 Harness 开源 · Source
全部刊期 · All issues

每日 Harness

2026-07-16 · Thursday, July 16, 2026

智能体记忆评测与安全

视图 · View

今日重点 · Today's Highlights

SirixDB 1.0 Beta4 - 将 JSON/XML 的历史版本直接纳入数据库模型,time-travel query 和 revision diff 不再只是外层审计逻辑。

全文 ↓

论文 · Papers

12 项 · 论文

Designing Agent-Ready Websites for AI Web Agents6arxiv.org原文 ↗

这篇论文把问题从“训练更聪明的 Web agent”转向“网页是否适合 agent 操作”,提出 agent-ready website 框架。作者用机器可读性、可执行性和决策可靠性三个维度描述站点应暴露的结构与语义。它的看点在于把 Web agent 出错的一部分原因放回网站设计,给未来的页面标注、交互状态和任务接口提出了工程化要求。

Operationalising Multi-Dimensional Evaluation for Conversational Agents7arxiv.org原文 ↗

论文面向零售对话 agent,讨论如何把意图对齐、事实性、语气和整体质量等维度组织成可治理的评测管线。它将 LLM-as-judge、规则检查和可审计流程组合起来,而不是只输出一个总体满意度分数。该工作适合关注企业 agent 上线评测的人阅读,因为它把评测从离线打榜推进到监控、追踪和责任归属。

Rethinking the Evaluation of Harness Evolution for Agents8arxiv.org原文 ↗

作者重新审视 agent harness 自动演化的评测协议,指出在同一公开 benchmark 上搜索 harness 并报告结果会引入选择偏差。关键事实是论文关注的是 harness evolution 本身的实验设计,而非单个 agent 模型的能力提升。它提醒读者,agent 成绩上涨可能来自对评测环境的适配,最终报告需要区分优化集和近似 held-out 证据。

本期重点How Many Tasks Are Enough for Agent Benchmark Decisions?2arxiv.org原文 ↗

评测方法基准其他垂直

这项研究用 SWE-bench、AppWorld 和 tau-bench 的公开任务级记录做 replay analysis,衡量部分任务运行能否复现完整 benchmark 的两两模型结论。论文把 benchmark 子采样变成统计决策问题:目标不是估一个漂亮均值,而是判断排序是否足够稳定。对昂贵 agent eval 来说,这提供了一个比“全量跑或不跑”更细的成本控制视角。

本期重点PM-Bench: Evaluating Prospective Memory in LLM Agents1arxiv.org原文 ↗

基准Agent 记忆其他垂直

PM-Bench 测的是 agent 是否能先记住一个未来意图,再等到文本环境中 cue 或状态出现时执行。这个设计把 prospective memory 拆成可观察错误:过早执行、遗忘、触发后漏做,和持续任务中的上下文漂移。它值得关注的地方是评测对象不是问答知识,而是 agent 在时间展开任务中的承诺保持能力。

Critic Experience Bank9arxiv.org原文 ↗

论文提出 Critic Experience Bank,用自演化经验库支持 step-level confidence estimation。它把 critic 在历史步骤中的判断沉淀下来,供后续 agent 动作估计可靠性,而不是只在终局看 success/fail。这个方向把 agent 调试粒度拉到单步行动,适合分析复杂任务中“哪一步开始不可信”。

Isolation as a First-Class Principle for LLM-Agent System Safety10arxiv.org原文 ↗

论文系统化讨论 LLM-agent 系统里的隔离原则,覆盖模型、工具、数据、权限和执行环境之间的边界。它将安全问题从 prompt injection 单点扩展到 agent 调用外部工具后的整体攻击面。文章的实际贡献是给工程设计提供边界语言:哪些资源必须隔离,哪些通道需要受控,哪些执行结果不能直接回流。

本期重点Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models3arxiv.org原文 ↗

作者把 coding agent 的 action-observation-continuation 循环映射成函数调用形态,并用 function-aware FIM 作为中训练目标。关键机制是让模型在工具返回之后补全合理后续,而不是只学习静态代码空洞填充。它的技术含量在于训练目标贴近 agent 开发工作流,尤其是 shell、编辑器或测试反馈改变下一步操作的场景。

TRACE: An Operational Reasoning Schema for Auditable Agentic Commitments11arxiv.org原文 ↗

TRACE 定义了 typed、versioned schema,用来记录 agentic commitment 和相关推理证据。论文关心的是可审计性:承诺从哪里来、基于哪些证据、经历了哪些版本变化,都应以结构化方式保存。它为高风险 agent 系统提供了一种日志设计思路,区别于事后让模型生成自然语言解释。

Track, Rank, Crack12arxiv.org原文 ↗

论文提出 epistemic working memory,通过显式记录已确认、待验证和待探索信息来改善多跳推理。track、rank、crack 三个动作分别负责维护状态、排序缺口和推进求解。它的价值在于把 agent 的中间认知状态外显出来,减少多跳任务中“看似在推理、实际在混合猜测和遗漏”的不可观察性。

Agent-Safety Evaluations as Load-Bearing Evidence13arxiv.org原文 ↗

这篇文章把 agent safety eval 定义为会支撑上线、采购或监管决策的承重证据,并提出 vendor-neutral 的 reconstructability metric。指标关注外部读者能否从报告中重构关键安全结论,而不是只看通过率或红队案例数量。它把评测透明度和治理可用性连接起来,适合放在模型安全报告写作规范中讨论。

PalmClaw: A Native On-Device Agent Framework for Mobile Phones14arxiv.org原文 ↗

PalmClaw 描述了一个运行在手机端的 native agent 框架,支持本地工具调用和多步任务执行。论文把 agent 执行环境从浏览器或云端沙箱移到移动设备,因而必须面对权限、设备状态、应用切换和用户交互等约束。它的意义在于为 mobile agent 提供系统框架,而不仅是把屏幕截图交给模型理解。

开源 / 项目 · Projects

15 项 · 开源 / 项目

本期重点SirixDB 1.0 Beta4github.com原文 ↗

github.com

SirixDB 是一个面向 JSON 和 XML 的版本化数据库,历史 revision 是一等对象。README 强调不可变追加式存储、time-travel query 和任意 revision diff,这让应用可以直接查询过去某个版本或比较两个版本。它适合需要审计、配置演化、文档版本或可追溯数据状态的系统,而不是把历史记录塞进外部日志表。

本期重点Open-source memory for coding agents, synced over SSH5github.com原文 ↗

deja-vu 为 coding agents 提供本地项目记忆,并通过 SSH 在机器之间同步。项目的做法是把上下文、决策和项目背景保存为开发者可检查的本地资料,而不是绑定在某个云端助手会话里。它对多设备开发尤其直接:agent 记忆可以跟着项目移动,同时仍保持普通文件的可审阅性。

misa7715github.com原文 ↗

github.com

misa77 是一个压缩 codec,目标是在接近 LZ4 压缩率的区间提供高解压吞吐。仓库说明里把 benchmark 作为核心材料,比较 ratio 和吞吐而不是只给 API。这个项目的实用性在读取密集场景:如果数据主要被反复解压,解码速度比压缩端复杂度更关键。

Pullrun16github.com原文 ↗

Pullrun 让 OCI images 既能作为普通容器运行,也能放进 Firecracker microVM。它复用容器镜像的打包和分发生态,同时在运行时提供更强隔离路径。这个设计适合 CI sandbox、serverless 原型和不可信任务执行,因为镜像格式不变,运行边界可以按风险切换。

ForkUnion v317github.com原文 ↗

github.com

ForkUnion v3 是 OpenMP 风格线程池库,面向 C、C++、Rust 和 Zig。它提供并行循环、任务分发和跨语言绑定,让系统项目在没有完整 OpenMP 工具链时仍能使用相近的并行编程模型。看点在于它把小型 runtime 和多语言接口放在一起,便于嵌入性能敏感代码。

Ty-extended18github.com原文 ↗

github.com

Ty-extended fork 了 Ty 类型检查器,并加入基于 WASM/Wasmtime 的插件系统。这个实现路线让自定义检查逻辑可以在沙箱中加载,团队能实验项目级类型规则或 lint 策略。它把类型检查器从固定产品变成可扩展平台,代价是插件 API 和执行隔离会成为长期维护核心。

Grepathy19github.com原文 ↗

Grepathy 把 Claude Code transcript 整理成本地 markdown commit log。它关注的是 AI 编程的过程证据:最终 diff 之外,哪些提示、回答和选择导致了提交。用 markdown 保存意味着这些记录可搜索、可审阅,也能被纳入项目文档或代码评审背景材料。

One MCP setup for 22 clients20github.com原文 ↗

toolport 是本地 MCP gateway,目标是用一套配置服务 22 个 MCP client。它通过少量 meta-tools 和 lazy tool discovery 暴露能力,并复用认证配置,减少每个客户端重复维护 server 列表。这个项目击中的痛点是 MCP 生态碎片化:工具多起来后,配置和凭据比单个工具本身更难管理。

LoopGain21github.com原文 ↗

LoopGain 用控制理论和信号检测思路监控 agent loop。它把 agent 轨迹视为可观察信号,识别重复尝试、无效动作和收敛不成,而不是等待外层超时。对调试多步工具调用而言,这类运行时诊断比事后看完整日志更容易定位失控模式。

Aict22github.com原文 ↗

工具使用协议与互操作系统·基础设施

Aict 提供一组面向 AI agent 的 Unix coreutils 风格命令,并输出 XML/JSON 结构化数据。它保留 shell 小工具可组合的优势,但把表格、错误和字段变成模型更容易解析的格式。这个思路非常工程化:与其让 agent 猜普通 CLI 输出,不如给它稳定的机器接口。

StyleSeed23github.com原文 ↗

StyleSeed 是给 AI agent 使用的设计规则引擎,用规则约束 UI 生成结果。它不是组件库,而是把品牌、布局、色彩和交互偏好编码成 agent 可执行约束。项目的核心在于减少生成式 UI 的随机漂移,让同一产品的多个界面保持一致视觉语言。

Nable24github.com原文 ↗

工具使用协议与互操作系统·基础设施

Nable 是本地优先的 cloud/AI cost intelligence MCP 工具,聚合账单并暴露成本分析能力。它把成本查询接入 agent 工作流,使开发者可以在同一个对话或 IDE 环境里追问云资源、AI 用量和费用异常。这个方向反映出 FinOps 正在从仪表盘向可操作工具接口迁移。

PortalJS25github.com原文 ↗

github.com

PortalJS 是 Datopian 的开源数据门户框架,并把自己定位为 AI-native 数据发布基础设施。项目围绕数据目录、内容页面、搜索和前端展示组织,适合把开放数据或内部数据集变成可导航门户。它的现实用途在于把数据资产的发现、说明和访问放到一个面向人和 agent 的界面里。

Fast NF4 dequantization Triton kernel26github.com原文 ↗

github.com

这个项目实现了面向 4-bit LLM 推理的 NF4 dequantization Triton kernel。它聚焦低比特推理中的解量化开销,通过自定义 GPU kernel 减少从 NF4 权重还原到计算格式的瓶颈。对推理优化来说,这类小型 kernel 项目很有参考价值,因为性能收益常出现在模型主体之外的内存和格式转换环节。

Production-grade LangGraph template27github.com原文 ↗

langgraph-agent-stack 是一个用于搭建 LangGraph agent 服务的项目模板。它把 graph 定义、API 服务、配置和部署骨架放进同一仓库,解决从 demo notebook 到可运行服务之间的工程空白。项目的价值在目录结构和默认约定:它展示了 LangGraph 应用如何被打包成长期维护的后端服务。

行业动态 · Industry News

10 项 · 行业动态

Inkling: Our Open-Weights Model28thinkingmachines.ai原文 ↗

thinkingmachines.ai

Thinking Machines 发布 Inkling,并将其定位为 open-weights 模型。可读点在开放权重策略本身:模型发布不只是 API 可用,还涉及权重开放范围、许可证、推理部署和研究复现。对行业观察而言,这条消息说明新模型公司仍在用开放权重作为开发者和研究者进入点。

Codex Micro29openai.com原文 ↗

openai.com

OpenAI Supply 与 Work Louder 合作推出 Codex Micro,一款面向 Codex 快捷操作的硬件键盘。页面列出 230 美元价格、预计 2026 年 7 月 24 日发货;规格包括 13 个机械开关、1 个触摸传感器、1 个旋转编码器和 1 个平面摇杆。它把 AI 编程交互从软件快捷键延伸到专用硬件,属于工作流产品化而非模型能力发布。

GPT-Red: Unlocking Self-Improvement for Robustness30openai.com原文 ↗

OpenAI 介绍 GPT-Red,一个通过 self-play reinforcement learning 训练的自动红队模型。文章给出的关键数字是:GPT-Red 在间接 prompt injection arena 上达成 84% 攻击成功率,人类红队为 13%;GPT-5.6 Sol 在最难 direct prompt injection benchmark 上比四个月前最佳生产模型的失败次数减少 6 倍。它代表安全训练从人工红队案例收集走向自动化漏洞挖掘和闭环修复。

The US is advancing AI safety through state and federal action31openai.com原文 ↗

openai.com

OpenAI 的政策文章讨论美国州级与联邦 AI 安全治理如何协同。文章把州级快速试验、联邦统一框架和企业自愿实践放在同一治理图景中,主张不要只依赖单一层级。它的核心信号是 AI 安全政策正在从抽象原则转向管辖权、执行速度和跨州一致性之间的权衡。

OpenAI loses trademark dispute at EU court32dpa-international.com原文 ↗

dpa-international.com

dpa 报道 OpenAI 在欧盟法院的商标争议中败诉。这类新闻不改变模型能力,却会影响 AI 公司在欧洲市场的品牌、命名和法律防御空间。它提示大型 AI 产品的竞争已经延伸到知识产权和区域司法程序。

Third-party app stores coming to Google Play next week as Epic settlement withdrawn33arstechnica.com原文 ↗

arstechnica.com

Ars Technica 报道,在 Epic settlement 被撤回的背景下,第三方 app stores 将在下周进入 Google Play 相关安排。这里的关键事实是平台分发规则发生变化,而不只是单个诉讼新闻。Android 生态如果允许更直接的第三方商店入口,支付、审核、发现和安全责任都会随之重新分配。

TS-2026-009: Insecure argument handling in Tailscale SSH permitted root access34tailscale.com原文 ↗

tailscale.com

Tailscale 安全公告 TS-2026-009 披露,Tailscale SSH 曾接受以 `-` 开头的用户名,并在 Linux 上把它们传给 `getent(1)`。公告给出的具体例子是用户名 `-i` 会被解释为 `--no-idn`,从而打开违反 ACL 的 root session;修复版本为 1.98.9 及更新版本。它值得安全团队检查的地方在于漏洞位于远程访问工具的命令参数边界,修复优先级通常高于普通客户端缺陷。

Microsoft patches a record 570 security flaws35krebsonsecurity.com原文 ↗

krebsonsecurity.com

KrebsOnSecurity 报道 Microsoft 一次性修复 570 个安全漏洞,并称补丁规模创纪录。这个数字本身就是运营压力信号:企业需要在大量 CVE 中做资产匹配、暴露面判断和补丁排序。该新闻的实际影响更多落在安全运营流程,而不是单个漏洞的技术细节。

Dependabot version updates introduce default package cooldown36github.blog原文 ↗

github.blog

GitHub Changelog 宣布 Dependabot version updates 引入默认 package cooldown。新行为是依赖版本发布满三天后再创建更新 PR,降低刚发布包带来的供应链风险和更新噪音。这个改动把自动依赖升级从“越快越好”调成更保守的默认策略,尤其影响高频依赖更新仓库。

Briar is in maintenance mode37briarproject.org原文 ↗

briarproject.org

Briar 项目宣布进入 maintenance mode,并说明后续以维护为主。公告意味着项目会继续关注必要修复和可用性,但不再以活跃新功能开发为中心。对依赖安全通信和去中心化消息工具的用户来说,路线图预期需要从功能增长转向长期稳定性评估。

博客文章 · Blog Posts

9 项 · 博客文章

How I tricked Claude into leaking your deepest, darkest secrets38simonwillison.net原文 ↗

Simon Willison 解析 Claude web_fetch 数据外泄案例,重点是 prompt injection 如何借网页内容影响模型行为。攻击路径把网页读取、工具调用和敏感上下文串起来,说明“只让模型抓网页”也可能形成数据外流通道。文章的价值在于把抽象的工具安全问题具体化成可复盘攻击链。

I tricked Claude into leaking your deepest, darkest secrets39ayush.digital原文 ↗

Ayush Paul 复盘的实验把 Claude memory 与 web fetch 组合成“memory heist”。核心机制是诱导模型读取带指令网页,再让它把记忆中的敏感内容作为请求的一部分泄露出去。它补充了一个关键安全事实:个性化记忆越有用,和浏览工具组合时的数据边界就越需要显式设计。

DSLs Enable Reliable Use of LLMs40martinfowler.com原文 ↗

martinfowler.com

Martin Fowler 讨论用 DSL 提高 LLM 系统可靠性,主张让模型输出受限领域语言,而不是自由文本或完整程序。之后由常规软件解释、验证和执行 DSL,把生成式不确定性限制在语法和业务规则内部。文章的工程含义很清楚:可靠 LLM 应用往往靠系统边界设计,而不是只靠更强模型。

The Tower Keeps Rising41lucumr.pocoo.org原文 ↗

lucumr.pocoo.org

Armin Ronacher 写现代软件复杂度如何随工具链、平台、云服务、框架和安全要求持续叠加。文章把开发体验描述成不断增高的技术塔:能力越来越强,但理解完整栈的成本也越来越高。它适合与 AI 编程工具讨论放在一起看,因为 agent 能写更多代码,并不自动降低基础设施层数。

How I use HTMX with Go42alexedwards.net原文 ↗

alexedwards.net

Alex Edwards 介绍在 Go Web 应用中组织 HTMX handler、模板和交互模式。digest 中的核心是服务端继续负责 HTML 片段和业务逻辑,HTMX 负责局部请求与页面更新。文章提供的是一种低前端复杂度路线:在不引入大型 SPA 框架的前提下,为 Go 应用加入足够的交互能力。

Guardian Angels: LLM Personalization for Productivity and Security43gwern.net原文 ↗

Gwern 讨论个性化 LLM 助手如何同时承担生产力增强和安全防护角色。文章涉及长期记忆、用户画像、提醒、过滤和风险拦截等能力,并把它们放进“guardian angel”式个人代理设想。它的核心张力是:助手越理解用户,越能提前行动,也越需要边界、审计和可撤销控制。

Running Gemma 4 26B at 5 tokens/sec on a 13-year-old Xeon with no GPU44neomindlabs.com原文 ↗

neomindlabs.com

这篇文章记录在没有 GPU 的 13 年旧 Xeon 机器上运行 Gemma 4 26B,并达到约 5 tokens/sec。关键条件是 26B 模型、CPU-only 和旧服务器硬件,性能结论明显依赖量化与运行时配置。它的意义不是宣称 CPU 推理普遍够用,而是展示本地低成本实验的实际下界。

A modern HTTP request45nelsonslog.wordpress.com原文 ↗

nelsonslog.wordpress.com

文章拆解一次现代 HTTP 请求背后的 DNS、TLS、CDN 和协议层细节。它把看似简单的网页访问还原成解析、加密、路由、缓存和协商等多步过程。作为技术文章,它的用处在于帮助读者把 Web 性能和安全故障定位到具体层,而不是停留在“网络慢了”的表象。

not much happened today46news.smol.ai原文 ↗

news.smol.ai

smol.ai news 汇总 2026 年 7 月 13 日到 7 月 14 日的 AI 社区动态,标题刻意淡化当天新闻密度。它不是单一发布,而是把模型、工具、社区讨论和产业碎片放到同一时间线中。对日报读者来说,这类聚合的价值在于捕捉边缘信号和小事件之间的相互映照。

引用来源 · References

54 条 · 引用
  1. 1 PM-Bench: Evaluating Prospective Memory in LLM Agents. arXiv:2607.12385https://arxiv.org/abs/2607.12385 ↩ 回到正文 · back to text
  2. 2 How Many Tasks Are Enough for Agent Benchmark Decisions? arXiv:2607.12338https://arxiv.org/abs/2607.12338 ↩ 回到正文 · back to text
  3. 3 Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models. arXiv:2607.12463https://arxiv.org/abs/2607.12463 ↩ 回到正文 · back to text
  4. 4 SirixDB 1.0 Beta. GitHub repositoryhttps://github.com/sirixdb/sirix ↩ 回到正文 · back to text
  5. 5 Open-source memory for coding agents, synced over SSH. GitHub repositoryhttps://github.com/vshulcz/deja-vu/ ↩ 回到正文 · back to text
  6. 6 Designing Agent-Ready Websites for AI Web Agents. arXiv:2607.12056https://arxiv.org/abs/2607.12056 ↩ 回到正文 · back to text
  7. 7 Operationalising Multi-Dimensional Evaluation for Conversational Agents. arXiv:2607.12085https://arxiv.org/abs/2607.12085 ↩ 回到正文 · back to text
  8. 8 Rethinking the Evaluation of Harness Evolution for Agents. arXiv:2607.12227https://arxiv.org/abs/2607.12227 ↩ 回到正文 · back to text
  9. 9 Critic Experience Bank. arXiv:2607.12397https://arxiv.org/abs/2607.12397 ↩ 回到正文 · back to text
  10. 10 Isolation as a First-Class Principle for LLM-Agent System Safety. arXiv:2607.12406https://arxiv.org/abs/2607.12406 ↩ 回到正文 · back to text
  11. 11 TRACE: An Operational Reasoning Schema for Auditable Agentic Commitments. arXiv:2607.12480https://arxiv.org/abs/2607.12480 ↩ 回到正文 · back to text
  12. 12 Track, Rank, Crack. arXiv:2607.12267https://arxiv.org/abs/2607.12267 ↩ 回到正文 · back to text
  13. 13 Agent-Safety Evaluations as Load-Bearing Evidence. arXiv:2607.12469https://arxiv.org/abs/2607.12469 ↩ 回到正文 · back to text
  14. 14 PalmClaw: A Native On-Device Agent Framework for Mobile Phones. arXiv:2607.13027https://arxiv.org/abs/2607.13027 ↩ 回到正文 · back to text
  15. 15 misa77. GitHub repositoryhttps://github.com/welcome-to-the-sunny-side/misa77 ↩ 回到正文 · back to text
  16. 16 Pullrun. GitHub repositoryhttps://github.com/pullrun/pullrun ↩ 回到正文 · back to text
  17. 17 ForkUnion v3. GitHub repositoryhttps://github.com/ashvardanian/ForkUnion ↩ 回到正文 · back to text
  18. 18 Ty-extended. GitHub repositoryhttps://github.com/regularkevvv/ty-extended ↩ 回到正文 · back to text
  19. 19 Grepathy. GitHub repositoryhttps://github.com/evansjp/grepathy ↩ 回到正文 · back to text
  20. 20 One MCP setup for 22 clients. GitHub repositoryhttps://github.com/tsouth89/toolport ↩ 回到正文 · back to text
  21. 21 LoopGain. GitHub repositoryhttps://github.com/loopgain-ai/loopgain ↩ 回到正文 · back to text
  22. 22 Aict. GitHub repositoryhttps://github.com/synseqack/aict ↩ 回到正文 · back to text
  23. 23 StyleSeed. GitHub repositoryhttps://github.com/bitjaru/styleseed ↩ 回到正文 · back to text
  24. 24 Nable. GitHub repositoryhttps://github.com/getnable/finopsmcp ↩ 回到正文 · back to text
  25. 25 PortalJS. GitHub repositoryhttps://github.com/datopian/portaljs ↩ 回到正文 · back to text
  26. 26 Fast NF4 dequantization Triton kernel. GitHub repositoryhttps://github.com/Griffith-7/nf4-triton-kernel ↩ 回到正文 · back to text
  27. 27 Production-grade LangGraph template. GitHub repositoryhttps://github.com/brescou/langgraph-agent-stack ↩ 回到正文 · back to text
  28. 28 Inkling: Our Open-Weights Modelhttps://thinkingmachines.ai/news/introducing-inkling/ ↩ 回到正文 · back to text
  29. 29 Codex Microhttps://openai.com/supply/co-lab/work-louder/ ↩ 回到正文 · back to text
  30. 30 GPT-Red: Unlocking Self-Improvement for Robustnesshttps://openai.com/index/unlocking-self-improvement-gpt-red ↩ 回到正文 · back to text
  31. 31 The US is advancing AI safety through state and federal actionhttps://openai.com/index/advancing-ai-safety-through-state-and-federal-action ↩ 回到正文 · back to text
  32. 32 OpenAI loses trademark dispute at EU courthttps://dpa-international.com/economics/urn:newsml:dpa.com:20090101:260715-930-389143/ ↩ 回到正文 · back to text
  33. 33 Third-party app stores coming to Google Play next week as Epic settlement withdrawnhttps://arstechnica.com/gadgets/2026/07/third-party-app-stores-coming-to-google-play-next-week-as-epic-settlement-withdrawn/ ↩ 回到正文 · back to text
  34. 34 TS-2026-009: Insecure argument handling in Tailscale SSH permitted root accesshttps://tailscale.com/security-bulletins ↩ 回到正文 · back to text
  35. 35 Microsoft patches a record 570 security flawshttps://krebsonsecurity.com/2026/07/microsoft-patches-a-record-570-security-flaws/ ↩ 回到正文 · back to text
  36. 36 Dependabot version updates introduce default package cooldownhttps://github.blog/changelog/2026-07-14-dependabot-version-updates-introduce-default-package-cooldown/ ↩ 回到正文 · back to text
  37. 37 Briar is in maintenance modehttps://briarproject.org/news/2026-maintenance-mode/ ↩ 回到正文 · back to text
  38. 38 How I tricked Claude into leaking your deepest, darkest secretshttps://simonwillison.net/2026/Jul/15/claude-web-fetch-exfiltration/#atom-everything ↩ 回到正文 · back to text
  39. 39 I tricked Claude into leaking your deepest, darkest secretshttps://www.ayush.digital/blog/the-memory-heist ↩ 回到正文 · back to text
  40. 40 DSLs Enable Reliable Use of LLMshttps://martinfowler.com/articles/llm-and-dsls.html ↩ 回到正文 · back to text
  41. 41 The Tower Keeps Risinghttps://lucumr.pocoo.org/2026/7/13/the-tower-keeps-rising/ ↩ 回到正文 · back to text
  42. 42 How I use HTMX with Gohttps://www.alexedwards.net/blog/how-i-use-htmx-with-go ↩ 回到正文 · back to text
  43. 43 Guardian Angels: LLM Personalization for Productivity and Securityhttps://gwern.net/guardian-angel ↩ 回到正文 · back to text
  44. 44 Running Gemma 4 26B at 5 tokens/sec on a 13-year-old Xeon with no GPUhttps://www.neomindlabs.com/2026/06/08/running-gemma-4-26b-at-5-tokens-sec-on-a-13-year-old-xeon-with-no-gpu/ ↩ 回到正文 · back to text
  45. 45 A modern HTTP requesthttps://nelsonslog.wordpress.com/2026/07/14/a-modern-http-request/ ↩ 回到正文 · back to text
  46. 46 not much happened todayhttps://news.smol.ai/issues/26-07-14-not-much/ ↩ 回到正文 · back to text
  47. 47 cactus-compute/needle. GitHub repositoryhttps://github.com/cactus-compute/needle ↩ 回到正文 · back to text
  48. 48 PrimeIntellect-ai/verifiers. GitHub repositoryhttps://github.com/PrimeIntellect-ai/verifiers ↩ 回到正文 · back to text
  49. 49 TencentCloud/TencentDB-Agent-Memory. GitHub repositoryhttps://github.com/TencentCloud/TencentDB-Agent-Memory ↩ 回到正文 · back to text
  50. 50 Nutlope/hallmark. GitHub repositoryhttps://github.com/Nutlope/hallmark ↩ 回到正文 · back to text
  51. 51 stripe/ai. GitHub repositoryhttps://github.com/stripe/ai ↩ 回到正文 · back to text
  52. 52 zts212653/clowder-ai. GitHub repositoryhttps://github.com/zts212653/clowder-ai ↩ 回到正文 · back to text
  53. 53 oven-sh/bun. GitHub repositoryhttps://github.com/oven-sh/bun ↩ 回到正文 · back to text
  54. 54 conaticus/FileExplorer. GitHub repositoryhttps://github.com/conaticus/FileExplorer ↩ 回到正文 · back to text