每日 Harness 开源 · Source
全部刊期 · All issues

每日 Harness

2026-10-03 · Saturday, October 3, 2026

智能体工程化与治理升级

视图 · View

今日重点 · Today's Highlights

[Agents Are Systems, Not Models](https://arxiv.org/abs/2610.01618)[^1] - 把 agent 评测从单一模型分数改成信息、推理、自检、时限和 backbone 的联合配置,并量化了重复运行本身造成的方差。

全文 ↓

[Heavy-Tailed Memory Traces in Long-Horizon Language Agents](https://arxiv.org/abs/2610.00010)[^2] - 用核心 - 长尾访问模型重新分配记忆预算,在保持状态覆盖的同时减少长程代理的上下文开销。

全文 ↓

[Fault-Tolerant Budget Conservation in Distributed Multi-Agent Delegation](https://arxiv.org/abs/2610.00349)[^3] - 将预算当作带 lineage 和幂等键的可结算 escrow 资源,给出迟到效果、分区和重复消息下的守恒证明。

全文 ↓

[pi pod](https://pipod.dev/)[^4] - 把每次 pi coding-agent 会话放入一次性 E2B/Daytona pod,并将分支、密钥和输出流接回本地工作流。

全文 ↓

[Spens](https://spens.refwd.ai/)[^5] - 以 Docker、nono、mitmproxy 组成可审计的 agent 沙箱,把网络、工具和文件变更统一记录。

全文 ↓

论文 · Papers

15 项 · 论文

When Do Causal World Models Help Modular LLM Agents6arxiv.org原文 ↗

推理与规划研究·科学

FedCausalCompose 从模块动作的 intervention-response 证据恢复跨服务因果接口,指出观察轨迹无法区分授权关系、媒介变量或隐藏触发器。作者证明未阻断 back-door 时存在不可消除的 interventional error,接口覆盖率上升且局部机制误差受控时才可能超过非因果下界;结构化 API 环境收益明显,叙事环境需额外注意力锚点。

–

From Proposal to Verified Effect: Praxa, an Evidence-Bound Harness for Governed AI Agent Execution7arxiv.org原文 ↗

Praxa 把提案、权限、派发、外部回读、对账和上线审核建成独立状态,由确定性 admission 与 brokered execution 连接。仓库审计通过 1,027/1,027 单元测试和 89/89 Workerd 测试,但 12 项 Terminal-Bench 试点两组都只通过 17/36;可靠性层还多用 37.49% 输入、50.73% 输出 token,因此架构证据强于效果证据。

–

What Should an Agent Remember? Disentangling Retention from Retrieval in Bounded-Memory Evaluation9arxiv.org原文 ↗

流式召回基准在同一批 300 个 seeded episodes 上分离“保留什么”和“取出什么”。固定访问权限后,query-aware 选择只贡献 15.5 个百分点,而混合比较宣称的 68.7 点优势有 53.2 点来自额外访问;受限 recency 条件的 319 次失败全是 eviction,提醒记忆评测不能把存储损失误判为排序问题。

–

When Harnesses Lose the Signal: Causal Evaluation of Recovery in LLM Agents10arxiv.org原文 ↗

论文从同一执行状态比较有无 recovery,把挽救本会失败的轨迹与打断本会成功的轨迹分别计量,并据此实现 Causal Intervention Router。CIR 只看恢复前可得信号,在 Qwen3-14B 的长程 ALFWorld 上将成功率从 70.33% 推到 73.33%;增益虽为 3 个百分点,却直接针对“平均成功率掩盖副作用”的评测盲点。

–

MemFit: Efficient Long-Term Agentic Memory17arxiv.org原文 ↗

MemFit 逐回合原文追加写入,以 segment summary 做索引,绕开传统记忆系统昂贵的 LLM 写入与压缩。检索阶段融合 lexical、semantic 和 cross-encoder reranking,覆盖文本及多模态 episode;在 LoCoMo、MemGallery、LongMemEval-S 上达到 SOTA,并将构建时间与成本降低数倍。

–

Groundability, Not Scale Alone: When Weak Reviewers Can Audit Strong Coding Agents18arxiv.org原文 ↗

研究 3 个 coding agent 的 411 条执行标注轨迹和 101 个控制案例,发现审阅模型大小不是可靠质量指标。冻结两种证据格式后,6 个审阅器有 5 个在 122 条留出轨迹上同时提高缺陷捕获和拒绝控制,2 个做到全量正确;在没有官方测试时,作者改用 patch-caused static error 与“未修改仓库先失败”的生成测试做级联审计。

–

PACE: Provenance-Aware Capability Enforcement for Tool-Using LLM Agents19arxiv.org原文 ↗

安全与攻防工具使用系统·基础设施

PACE 将执行前最后一道边界设为能力闸门:path confinement 切断可表示的影响路径,效果验证再与认证请求编译出的 authority 对照。论文给出一个重要限制:安全变体与泄漏变体可能产生同一 admission evidence,所以仅做准入审核无法放宽权限,必须在具体 tool call 落地前重新核验。

–

Agent Evaluation Reliability: More Tasks Won't (Always) Fix An Agent Leaderboard20arxiv.org原文 ↗

评测方法基准研究·科学

作者用 Bayesian 方差分解分析 Holistic Agent Leaderboard 与 Harbor Index 的 22 个基准,把服务于目标结论的 signal 与会改变名次的无关 noise 分开。由此得到的警告是“可重复排序部署系统”不等于“可重复排序底层模型”,排行榜的可靠性要先明确测量对象,盲目加任务并不保证收敛。

–

开源 / 项目 · Projects

13 项 · 开源 / 项目

LDraw Nova21github.com原文 ↗

ldraw-nova 让 agent 以 plan.json 描述部件、子模型和几何,再生成 Python generator 产出 LDraw MPD;渲染、碰撞/间隙检查和示例库形成闭环。Docker web app 还能导出 3D/VR 视图、glTF 和对话记录,但 README 承认大型正确模型仍依赖高端模型且生成较慢,语义重排不可用时只能退回全文检索。

–

Bolo Formalization22github.com原文 ↗

github.com

项目把《From Linearity to Borrowing》逐节翻译成 Lean 4 定义、定理与证明,`Paper/INDEX.md` 对应论文每个编号结果。已机械化 Fundamental Property,并从类型推导证明闭合程序能从空内存运行到 `unit`;仓库还明确标出哪些证明是对原论文补写或对语义定义的修订。

–

Kokoallovero23github.com原文 ↗

github.com

这是面向 CPU 的独立 C++ Kokoro-82M TTS 引擎,输入文本、输出 24 kHz 音频,单二进制不需要 Python、espeak 或运行时下载,SIMD 由 Highway 运行时派发。README 的 6.6 秒 `af_heart` 测试在 i7-14700F 与 i7-7700 上都约为 PyTorch 的 1.95 倍速度,并提供约 350 MB 资产嵌入和静态链接选项。

–

Gitorange24github.com原文 ↗

github.com

GitOrange 将单租户 GitHub 风格界面部署为一个 Cloudflare Worker,仓库存 Cloudflare Artifacts,元数据进 D1,因此不用维护 VM、磁盘备份或 git daemon。它在 Cloudflare Containers 运行现有 `.github/workflows/*.yml`,典型 checkout、Node、test 流程无需改写;代价是要求 Workers Paid、邮件域名和 beta Artifacts,仓库 secrets 目前仍未支持。

–

Enki25github.com原文 ↗

github.com

Enki 用纯 Rust 的 JIT 将同一函数编译到 GPU 或多线程 CPU,不依赖 nightly 或外部着色语言。示例以 `#[nam]` 声明向量 kernel、`gpu_vec!` 分配 VRAM,并在 CPU 上逐项执行相同函数;raymarching demo 可实时切换两条执行路径,展示 host/accelerator 共享源码的目标。

–

本期重点pi pod4pipod.dev原文 ↗

pi pod 的一次性 pod 生命周期从当前分支克隆开始,随后注入 secrets、远程跑 Pi agent loop,再将事件流返回本地 TUI。它把会话隔离、分支同步和多设备控制平面拆开,适合把本地 agent 的工具执行移到 E2B/Daytona,而不改变交互入口。

–

DynamicTune26github.com原文 ↗

蒸馏与压缩研究·科学

DynamicTune 把教师隐藏轨迹视为表示空间中的信息速度场,以局部正交 Procrustes 对齐并直接闭式修改学生 MLP 权重,省掉反向传播和训练数据管线。跨 Qwen3.5 4B→0.8B、GPT-2 XL→small 的测试显示,只改 0、7、15、23 层可使多域 held-out NLL 降 10.8%;全 24 层修改会让 NLL 增 64.78%,说明选择编辑位置本身是主要算法问题。

–

UseJunction27github.com原文 ↗

UseJunction 面向工程与平台团队汇总 Cursor、Claude Code、Codex、Copilot、Ollama 等工具的用量、费用、延迟、计划上限、闲置席位和设备覆盖。它区分供应商已报账的 verified usage 与本地扫描/费率卡估算,不采用键盘记录或全网拦截;README 列出的 macOS/Windows 组合已在真实机器验证。

–

Agent-SDK-go28github.com原文 ↗

这个 Go SDK 以 durable-go 日志让 agent 在进程崩溃后恢复状态、工具调用和审批,也能把同一接口接到 Temporal 或 Restate 做跨进程执行。组件覆盖 MCP/A2A、子 agent、RAG、预算、hooks、OpenTelemetry 和 AG-UI streaming;本地 runtime 零基础设施即可运行,流事件还支持重连。

–

本期重点Spens5spens.refwd.ai原文 ↗

Spens 将 agent 容器与 interceptor 容器放进隔离 Docker 网络,DNS、HTTP、工具调用和文件变化都进入可检索审计日志。API key 以占位符留在容器内,只在获准域名的请求边界替换;项目明确承认 Docker 逃逸风险,gVisor 是额外加固而不是默认保证。

–

Graphene29github.com原文 ↗

Graphene 面向 coding agent 提供 SQL 语义层和 dashboard 文件格式:前者把指标与 modeled joins 纳入查询,后者以 HTML/CSS/JavaScript/ECharts 生成可复用页面。它坚持 everything-as-code,SQL 支持 170 多个函数并可进 Git/CI,agent 可在运行前验证、截图迭代和回滚,而非把结果锁在一次性 notebook。

–

Pyxel30github.com原文 ↗

github.com

Pyxel 用 16 色、4 声道等复古硬件约束,让 Python 用户直接制作像素风游戏,同时内置 image、tilemap、sound、music 编辑器。MIT 许可项目覆盖 Windows、macOS、Linux 与 WASM,应用还能打包成可执行文件或 HTML;仓库通过示例、指南和用户作品集保持低门槛。

–

Zig v0.17.031ziglang.org原文 ↗

ziglang.org

release-notes 页面本次抓取受限,digest 将其归为编译器、标准库和工具链变更。同期开发说明已明确 build 系统方向:把 `build.zig` 配置与 runner 分开并缓存序列化配置,减少每次 `zig build` 重跑配置的成本,同时改变脚本读取命令行参数的兼容边界。

–

行业动态 · Industry News

12 项 · 行业动态

Supabase is acquiring Turso32supabase.com原文 ↗

supabase.com

Supabase 宣布收购 Turso,公开口径是继续以 Postgres 为主、让 Turso 延续 SQLite,同时共同解决 agent 大量创建轻量数据库的基础设施问题。公告给出的规模信号是 Supabase 每周已启动超过一百万个数据库,收购逻辑因此更接近“按 agent/任务隔离的数据库供给”而非单纯产品线合并。

–

Power approval set to delay Oracle's Wisconsin AI datacenter33theregister.com原文 ↗

theregister.com

报道称 Oracle 威斯康星 AI 数据中心要等州监管者批准超过 20 亿美元的输电建设才能接入电力,市场基准把满功率时间推到 2028 年 10 月。这个时间点晚于 2027 年下半年交付目标,显示 AI 基础设施的关键约束已从 GPU 采购延伸到电网审批和送电测试窗口。

–

Mozilla shutting down Solo AI website creator34support.soloist.ai原文 ↗

support.soloist.ai

Solo 支持页给出的硬截止日期是 2026 年 11 月 30 日,届时站点、账户和数据全部删除且不可恢复。迁移包只含 HTML、图片链接 CSV、联系表单和 newsletter 提交,原图须逐张下载;活跃 Pro/Grow 订阅按 10 月 1 日比例退款,域名则转往 Name.com。

–

Updates to Full Disk Access in macOS35developer.apple.com原文 ↗

developer.apple.com

Apple 承认 Full Disk Access 为备份软件提供便利,却可能让应用无感读取文件、邮件、消息、浏览历史并波及通信对象。后续系统会要求更明确的用户动作才能授予这一权限,公告把自主 AI agent 直接列为风险上升的理由,权限 UX 将成为 agent 产品设计的一部分。

–

GrapheneOS has fixed the Android 17 QPR1 kernel performance regression36discuss.grapheneos.org原文 ↗

discuss.grapheneos.org

GrapheneOS 修复了 Android 17 QPR1 Pixel driver tree 在内存压力下造成的卡顿、冻结和 stall-kill,并公开对应内核提交。项目还在尝试减少 secure spawning 的内存开销,计划在 2026 年 11 月前评估发布;事件反映第三方系统需要自行承担上游回归的测试与交付节奏。

–

Cloudflare K2: serverless event streams38blog.cloudflare.com原文 ↗

blog.cloudflare.com

K2 在 public beta 中提供带长期保留的有序事件日志,让生产者与消费者按各自速度解耦,并支持分片消费或广播。其实现把分区 durable log 放在 R2 上,利用对象存储的一致性和复制能力来适应 Cloudflare 横跨 335 多座城市、节点短暂且网络跨公网的边缘条件。

–

Chatham scales its capital markets expertise with OpenAI39openai.com原文 ↗

openai.com

Chatham 将 Codex 放入 Onyx 的计划、开发、测试、文档和审阅环节,并让 ChatFIN 从历史市场数据提取模式、解释组合和链接债务/衍生品/租赁条款。平台同时使用 GPT-5.6 Sol、Terra、GPT-5.4 和 GPT-4.1 按成本与复杂度路由,保留顾问对例外和客户交付的最终判断。

–

A model guide for the GPT-6 family40openai.com原文 ↗

OpenAI 将 Astra、Sol 和 Luna 按推理难度、复杂编码/研究与规模化重复任务分层,并建议把 reasoning effort 作为可调资源而非固定模型属性。指南给出工程化数字:prompt caching 的输入成本最高可降 95%,长期工作还应结合 compaction、并行工具和 mid-turn steering,再以每个成功任务的质量、延迟、成本做验收。

–

Memory executives expect RAM shortage to continue through 202841arstechnica.com原文 ↗

arstechnica.com

Ars 引述 Micron CEO 称 2027 年约 75% 内存产量已被预订,AI 所需 HBM 和服务器 DRAM 正挤占消费电子供给。即便 2028 年新增 clean room,晶圆爬坡、HBM 代际转换和每片晶圆收益下降仍会拖慢平衡,短期价格压力并非只来自单一厂商扩产不足。

–

F.02 Decommission42figure.ai原文 ↗

figure.ai

Figure 为给 F.03 和 F.04 释放工程资源,选择将含定制执行器与知识产权的 F.02 机队退役;拆解每台会拖慢下一代发布,于是把大部分机体送到芬兰 75 吨电弧炉熔化。团队在 24 小时、六次熔炼窗口内训练模型让机器人自主跳入钢水,回收金属将制成限量纪念品,少数机体留存总部。

–

Our Project Suncatcher prototype satellite is in orbit43blog.google原文 ↗

blog.google

Google 与 Planet 合作的 Suncatcher 原型搭乘 SpaceX Transporter-18 入轨,团队已确认通信与正常运行。接下来数周的实验重点不是展示算力,而是测量 TPU 经受发射振动、辐射和热循环后的行为,为可扩展轨道机器学习基础设施提供第一手工程数据。

–

博客文章 · Blog Posts

12 项 · 博客文章

The Harness Is the Company44blog.sshh.io原文 ↗

文章把 harness 定义为围绕无状态 LLM 的上下文、状态、工具、权限和人工评审,并描绘 SaaS 从“人操作”转向“harness 编排人”的四阶段。作者据此把顶层 harness 视作企业应自有的核心能力:它决定何时调用供应商、把哪些问题交给 taste-holder、以及如何把领域知识留在反馈回路中。

–

Everyone's Packing Up45widdershins.verja.net原文 ↗

widdershins.verja.net

作者把 Reddit、WordPress、Discord、GitHub、Codeberg 和小型 web 服务的迁移/关闭叙事放在一起,原因包括涨价、AI 训练、换东家与政策偏离用户。迁移目的地常是个人站、自托管或 Gopher/Gemini:牺牲可发现性换控制权,说明“平台还在”与“社区创造力仍在平台内”已不是同一件事。

–

The Four Horsemen of Agentic Coding46distantprovince.substack.com原文 ↗

文章把 agentic coding 的风险命名为 slop、疏离、技能退化和团队关系瓦解,关注的是工作结构而非单次代码正确率。它指出 prompt 操作会把维护、诊断和审美判断推到代码产出之后,短期产能指标可能掩盖长期无人理解系统的成本;正文主要是诊断,尚未提供可验证的治理处方。

–

The death of web development education47molily.de原文 ↗

molily.de

文章汇总多位 Web 教育者的收入变化:Axel Rauschmayer 称书籍收入从 2024 年可谋生降至 2026 年为零,Josh Comeau 报告课程收入下降超过一半;同时 AI crawler 让免费内容流量上升却不带来广告收入。作者把问题归因于知识被集中抽取和商品化,主张为教育者建立新的付费与独立社区机制。

–

Meta's Muse is fantastic for web scraping49sigh.dev原文 ↗

作者让 Muse 用自然语言编排跨站抓取,例如扫描 Reddit/YouTube 找 1,000 个视频,或遍历 Coachella 艺术家再逐人查询演出。文章的实际价值在于展示多步筛选、分页和结果汇总如何被统一成一个 agent 任务,同时也把 Amazon 等大规模抓取的速率、条款和合规边界留作未解问题。

–

Git 3.0's upcoming SHA-256 default will be a costly mistake50blog.gitbutler.com原文 ↗

blog.gitbutler.com

Scott Chacon 认为 SHA-256 默认化把理论碰撞风险转成全生态迁移负担:SHA-1/SHA-256 仓库不能混用,子模块、签名、旧链接和大量非核心 Git 库都要同步改造。文章举例现有仓库转换会重写每个对象并打断协作,主张把信任放在来源认证、签名和分发渠道,而不是强迫所有项目为极少见的攻击模型付费。

–

Advice to a beginning software engineer51seangoedecke.com原文 ↗

seangoedecke.com

作者给初级工程师的中心建议是友善、负责、真正理解系统,并依据现实议价能力选择何时发起冲突。对 AI 的态度是双重的:不要拒绝公司会要求使用的工具,也不要把判断交给模型;“先追问到自己理解,再决定是否采纳”被视为保持技术成长的最低线。

–

Frog and Toad and the Increasingly Capable Machines52frogandtoad.ai原文 ↗

frogandtoad.ai

这套短篇图文借 Frog and Toad 的儿童故事语气解释 Hugging Face、METR 与能力增强机器,目标是让非技术家人进入讨论。读者一方面认可低门槛叙事,另一方面指出标点错误及拟人化说教可能造成反效果,恰好说明 AI 科普不仅是简化事实,还要处理受众尊重和风格模仿边界。

–

The hidden design compromises of Docker layers53loige.co原文 ↗

loige.co

文章借 SOCI 的 seekable index 和 lazy loading 重新拆解 Docker layer:层是依次应用的 tar 归档,删除旧文件依赖 whiteout,历史数据仍占存储。由此可见压缩、按需取文件、缓存复用和启动速度互相牵制,镜像优化不能只看最终 filesystem 大小。

–

Keeping Futhark off the GPU54futhark-lang.org原文 ↗

futhark-lang.org

Futhark 用 `#[cpu_function]` 把图着色等顺序函数固定到 CPU,同时让同一程序的并行 map 留在 GPU;输入和中间数组在 CPU,返回 GPU 前做一次批量复制。作者承认这是带尖角的临时 hack,但它避免了循环内逐元素迁移,并为未来按数据依赖自动推断内存空间保留接口。

–

The forgetful CPU (Linux on M4)55yuka.dev原文 ↗

yuka.dev

M4 首次强制 SPTM,破坏了 Asahi 过去依靠 m1n1 捕获 macOS MMIO trace 的 bring-up 路径;raw boot 还会因 GXF 被锁和 RVBAR 写入触发崩溃。作者通过跳过这些初始化、关闭严格启动安全并接入串口逐步启动 Linux,案例展示硬件安全机制如何把“支持新芯片”从驱动移植变成引导链逆向工程。

–

引用来源 · References

55 条 · 引用
  1. 1 Agents Are Systems, Not Models: Rethinking Agentic Evaluation. arXiv:2610.01618https://arxiv.org/abs/2610.01618 ↩ 回到正文 · back to text
  2. 2 Heavy-Tailed Memory Traces in Long-Horizon Language Agents. arXiv:2610.00010https://arxiv.org/abs/2610.00010 ↩ 回到正文 · back to text
  3. 3 Fault-Tolerant Budget Conservation in Distributed Multi-Agent Delegation. arXiv:2610.00349https://arxiv.org/abs/2610.00349 ↩ 回到正文 · back to text
  4. 4 pi podhttps://pipod.dev/ ↩ 回到正文 · back to text
  5. 5 Spenshttps://spens.refwd.ai/ ↩ 回到正文 · back to text
  6. 6 When Do Causal World Models Help Modular LLM Agents. arXiv:2610.00012https://arxiv.org/abs/2610.00012 ↩ 回到正文 · back to text
  7. 7 From Proposal to Verified Effect: Praxa, an Evidence-Bound Harness for Governed AI Agent Execution. arXiv:2610.00015https://arxiv.org/abs/2610.00015 ↩ 回到正文 · back to text
  8. 8 Measuring the Microtask Eligibility Gap: When Is an Off-the-Shelf SLM Enough for an Agent Harness? arXiv:2610.00025https://arxiv.org/abs/2610.00025 ↩ 回到正文 · back to text
  9. 9 What Should an Agent Remember? Disentangling Retention from Retrieval in Bounded-Memory Evaluation. arXiv:2610.00366https://arxiv.org/abs/2610.00366 ↩ 回到正文 · back to text
  10. 10 When Harnesses Lose the Signal: Causal Evaluation of Recovery in LLM Agents. arXiv:2610.00372https://arxiv.org/abs/2610.00372 ↩ 回到正文 · back to text
  11. 11 ReLiveGym: Evaluating Long-Lived Agents over Weeks of Replayed Reality. arXiv:2610.00710https://arxiv.org/abs/2610.00710 ↩ 回到正文 · back to text
  12. 12 ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization. arXiv:2610.00906https://arxiv.org/abs/2610.00906 ↩ 回到正文 · back to text
  13. 13 Finding the Right Fit: Model-Harness Interactions across Agent Tasks. arXiv:2610.00917https://arxiv.org/abs/2610.00917 ↩ 回到正文 · back to text
  14. 14 VeriHarness: Scaling Agentic Verification for Long-Horizon Tasks. arXiv:2610.00972https://arxiv.org/abs/2610.00972 ↩ 回到正文 · back to text
  15. 15 Learning to Ask: Information Acquisition for SLM-LLM Collaboration, under a budget. arXiv:2610.01236https://arxiv.org/abs/2610.01236 ↩ 回到正文 · back to text
  16. 16 Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States. arXiv:2610.01415https://arxiv.org/abs/2610.01415 ↩ 回到正文 · back to text
  17. 17 MemFit: Efficient Long-Term Agentic Memory. arXiv:2610.00872https://arxiv.org/abs/2610.00872 ↩ 回到正文 · back to text
  18. 18 Groundability, Not Scale Alone: When Weak Reviewers Can Audit Strong Coding Agents. arXiv:2610.01023https://arxiv.org/abs/2610.01023 ↩ 回到正文 · back to text
  19. 19 PACE: Provenance-Aware Capability Enforcement for Tool-Using LLM Agents. arXiv:2610.01349https://arxiv.org/abs/2610.01349 ↩ 回到正文 · back to text
  20. 20 Agent Evaluation Reliability: More Tasks Won't (Always) Fix An Agent Leaderboard. arXiv:2610.00651https://arxiv.org/abs/2610.00651 ↩ 回到正文 · back to text
  21. 21 LDraw Novahttps://github.com/anteloc/ldraw-nova ↩ 回到正文 · back to text
  22. 22 Bolo Formalizationhttps://github.com/empath-nirvana/bolo-formalization ↩ 回到正文 · back to text
  23. 23 Kokoalloverohttps://github.com/RobViren/kokoallovero ↩ 回到正文 · back to text
  24. 24 Gitorangehttps://github.com/choyiny/gitorange ↩ 回到正文 · back to text
  25. 25 Enkihttps://github.com/enkiruntime/enki ↩ 回到正文 · back to text
  26. 26 DynamicTunehttps://github.com/dsadawq3/DynamicTune ↩ 回到正文 · back to text
  27. 27 UseJunctionhttps://github.com/use-junction/usejunction ↩ 回到正文 · back to text
  28. 28 Agent-SDK-gohttps://github.com/agenticenv/agent-sdk-go ↩ 回到正文 · back to text
  29. 29 Graphenehttps://github.com/graphene-data/graphene ↩ 回到正文 · back to text
  30. 30 Pyxelhttps://github.com/kitao/pyxel ↩ 回到正文 · back to text
  31. 31 Zig v0.17.0https://ziglang.org/download/0.17.0/release-notes.html ↩ 回到正文 · back to text
  32. 32 Supabase is acquiring Tursohttps://supabase.com/blog/supabase-is-acquiring-turso ↩ 回到正文 · back to text
  33. 33 Power approval set to delay Oracle's Wisconsin AI datacenterhttps://www.theregister.com/on-prem/2026/10/02/power-approval-set-to-delay-oracles-wisconsin-ai-datacenter/5300832 ↩ 回到正文 · back to text
  34. 34 Mozilla shutting down Solo AI website creatorhttps://support.soloist.ai/doc/solo-shutdown-faq ↩ 回到正文 · back to text
  35. 35 Updates to Full Disk Access in macOShttps://developer.apple.com/news/?id=p6zjojqw ↩ 回到正文 · back to text
  36. 36 GrapheneOS has fixed the Android 17 QPR1 kernel performance regressionhttps://discuss.grapheneos.org/d/42511-grapheneos-has-fixed-the-massive-android-17-qpr1-kernel-performance-regression ↩ 回到正文 · back to text
  37. 37 DeepSeek Harness Desktop for macOS and Windowshttps://www.deepseek.com/en/harness/ ↩ 回到正文 · back to text
  38. 38 Cloudflare K2: serverless event streamshttps://blog.cloudflare.com/cloudflare-k2-streams/ ↩ 回到正文 · back to text
  39. 39 Chatham scales its capital markets expertise with OpenAIhttps://openai.com/index/chatham-financial ↩ 回到正文 · back to text
  40. 40 A model guide for the GPT-6 familyhttps://openai.com/index/practical-guide-building-gpt-6 ↩ 回到正文 · back to text
  41. 41 Memory executives expect RAM shortage to continue through 2028https://arstechnica.com/information-technology/2026/10/memory-supplies-are-only-getting-tighter-micron-ceo-says/ ↩ 回到正文 · back to text
  42. 42 F.02 Decommissionhttps://www.figure.ai/news/f-02-decommission ↩ 回到正文 · back to text
  43. 43 Our Project Suncatcher prototype satellite is in orbithttps://blog.google/innovation-and-ai/models-and-research/google-research/project-suncatcher-prototype/ ↩ 回到正文 · back to text
  44. 44 The Harness Is the Companyhttps://blog.sshh.io/p/the-harness-is-the-company ↩ 回到正文 · back to text
  45. 45 Everyone's Packing Uphttps://widdershins.verja.net/everyones-packing-up/ ↩ 回到正文 · back to text
  46. 46 The Four Horsemen of Agentic Codinghttps://distantprovince.substack.com/p/the-four-horsemen-of-agentic-coding ↩ 回到正文 · back to text
  47. 47 The death of web development educationhttps://molily.de/web-dev-education/ ↩ 回到正文 · back to text
  48. 48 Using Opus 5.5 to discover a new eyewitness record of the dodohttps://resobscura.substack.com/p/using-opus-55-to-discover-a-new-eyewitness ↩ 回到正文 · back to text
  49. 49 Meta's Muse is fantastic for web scrapinghttps://sigh.dev/posts/metas-muse-is-fantastic-for-web-scraping/ ↩ 回到正文 · back to text
  50. 50 Git 3.0's upcoming SHA-256 default will be a costly mistakehttps://blog.gitbutler.com/git-3-sha-256 ↩ 回到正文 · back to text
  51. 51 Advice to a beginning software engineerhttps://www.seangoedecke.com/advice-to-a-beginning-software-engineer/ ↩ 回到正文 · back to text
  52. 52 Frog and Toad and the Increasingly Capable Machineshttps://www.frogandtoad.ai/ ↩ 回到正文 · back to text
  53. 53 The hidden design compromises of Docker layershttps://loige.co/hidden-design-compromises-of-docker-layers/ ↩ 回到正文 · back to text
  54. 54 Keeping Futhark off the GPUhttps://futhark-lang.org/blog/2026-10-02-cpu_function.html ↩ 回到正文 · back to text
  55. 55 The forgetful CPU (Linux on M4)https://yuka.dev/blog-2026-10-02-linux-m4.html ↩ 回到正文 · back to text