[Agents Are Systems, Not Models](https://arxiv.org/abs/2610.01618)[^1] - 把 agent 评测从单一模型分数改成信息、推理、自检、时限和 backbone 的联合配置,并量化了重复运行本身造成的方差。
全文 ↓今日重点 · Today's Highlights
[Heavy-Tailed Memory Traces in Long-Horizon Language Agents](https://arxiv.org/abs/2610.00010)[^2] - 用核心 - 长尾访问模型重新分配记忆预算,在保持状态覆盖的同时减少长程代理的上下文开销。
全文 ↓[Fault-Tolerant Budget Conservation in Distributed Multi-Agent Delegation](https://arxiv.org/abs/2610.00349)[^3] - 将预算当作带 lineage 和幂等键的可结算 escrow 资源,给出迟到效果、分区和重复消息下的守恒证明。
全文 ↓[pi pod](https://pipod.dev/)[^4] - 把每次 pi coding-agent 会话放入一次性 E2B/Daytona pod,并将分支、密钥和输出流接回本地工作流。
全文 ↓[Spens](https://spens.refwd.ai/)[^5] - 以 Docker、nono、mitmproxy 组成可审计的 agent 沙箱,把网络、工具和文件变更统一记录。
全文 ↓论文 · Papers
15 项 · 论文When Do Causal World Models Help Modular LLM Agents6arxiv.org原文 ↗
FedCausalCompose 从模块动作的 intervention-response 证据恢复跨服务因果接口,指出观察轨迹无法区分授权关系、媒介变量或隐藏触发器。作者证明未阻断 back-door 时存在不可消除的 interventional error,接口覆盖率上升且局部机制误差受控时才可能超过非因果下界;结构化 API 环境收益明显,叙事环境需额外注意力锚点。
From Proposal to Verified Effect: Praxa, an Evidence-Bound Harness for Governed AI Agent Execution7arxiv.org原文 ↗
Praxa 把提案、权限、派发、外部回读、对账和上线审核建成独立状态,由确定性 admission 与 brokered execution 连接。仓库审计通过 1,027/1,027 单元测试和 89/89 Workerd 测试,但 12 项 Terminal-Bench 试点两组都只通过 17/36;可靠性层还多用 37.49% 输入、50.73% 输出 token,因此架构证据强于效果证据。
Measuring the Microtask Eligibility Gap: When Is an Off-the-Shelf SLM Enough for an Agent Harness?8arxiv.org原文 ↗
研究将命令审批、记忆写入、工具选择和历史排序拆成四个带置信区间门槛的微任务。Qwen3 0.6B、1.7B、4B、8B 的 16 个配置全部未达标,4-bit RTN/GPTQ/AWQ 也没有把任何配置推过门槛;Llama-3.x 复测 12/12 仍不合格,说明量化不是弥补能力缺口的捷径。
What Should an Agent Remember? Disentangling Retention from Retrieval in Bounded-Memory Evaluation9arxiv.org原文 ↗
流式召回基准在同一批 300 个 seeded episodes 上分离“保留什么”和“取出什么”。固定访问权限后,query-aware 选择只贡献 15.5 个百分点,而混合比较宣称的 68.7 点优势有 53.2 点来自额外访问;受限 recency 条件的 319 次失败全是 eviction,提醒记忆评测不能把存储损失误判为排序问题。
When Harnesses Lose the Signal: Causal Evaluation of Recovery in LLM Agents10arxiv.org原文 ↗
论文从同一执行状态比较有无 recovery,把挽救本会失败的轨迹与打断本会成功的轨迹分别计量,并据此实现 Causal Intervention Router。CIR 只看恢复前可得信号,在 Qwen3-14B 的长程 ALFWorld 上将成功率从 70.33% 推到 73.33%;增益虽为 3 个百分点,却直接针对“平均成功率掩盖副作用”的评测盲点。
ReLiveGym: Evaluating Long-Lived Agents over Weeks of Replayed Reality11arxiv.org原文 ↗
ReLiveGym 用按时间回放的新闻、市场和社交媒体流构造数周任务,代理必须在稀疏触发点行动并适应变化。八个基础模型的对比把“等多久再做”和“环境已发生什么”纳入同一测试面,弥补静态长程环境无法测量时序适应的缺陷。
ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization12arxiv.org原文 ↗
ActiveSaddler 将训练场景选择视为随 harness 演化的非平稳 bandit,并为动态实例化的优化目标挑选反馈样本。它改变的是反馈分布而不只是更新规则:当提示、工具接口或控制逻辑已变,下一轮最有价值的失败案例也会随之变化。
Finding the Right Fit: Model-Harness Interactions across Agent Tasks13arxiv.org原文 ↗
研究在三套基准上测了 66 个模型 - harness 配对,显示模型排名会随执行框架翻转。Terminal-Bench 4 中 Claude 在 OpenHands 比 GPT 高 7.94 分,却在 PI 低 30.16 分;openJiuwen 让 Kimi 在三项基准均达到自身最高,优势介于 5.61 - 11.11 分,厂商原生 harness 并非稳定最优。
VeriHarness: Scaling Agentic Verification for Long-Horizon Tasks14arxiv.org原文 ↗
VeriHarness 把生成模型改造成带工作区、证据工具和可复用技能的验证代理,分别处理 rollout 间的分歧和共同错误。作者观察到多数意见可能共同遗漏要求,而不一致反而暴露正确候选;因此 resolver 会回查环境证据,challenger 会专门攻击共识声明。
Learning to Ask: Information Acquisition for SLM-LLM Collaboration, under a budget15arxiv.org原文 ↗
该方法让 SLM 保持主推理角色,把 LLM 当作按需咨询的黑盒信息源,以定向问题替代整段上下文转交。问题被建模成 API 预算下的信息获取,核心变量是何时提问及提问内容能否改变后续行动,而不是简单决定哪一个模型接管任务。
Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States16arxiv.org原文 ↗
PoS 持续维护由当前世界估计和未解任务要求组成的显式 belief,并检查其一致性和进度。系统识别“Belief Trapping”这一持续行动却不接近目标的状态,再按陷阱模式和缺失要求定制恢复,避免把历史记录堆积误当作世界理解。
MemFit: Efficient Long-Term Agentic Memory17arxiv.org原文 ↗
MemFit 逐回合原文追加写入,以 segment summary 做索引,绕开传统记忆系统昂贵的 LLM 写入与压缩。检索阶段融合 lexical、semantic 和 cross-encoder reranking,覆盖文本及多模态 episode;在 LoCoMo、MemGallery、LongMemEval-S 上达到 SOTA,并将构建时间与成本降低数倍。
Groundability, Not Scale Alone: When Weak Reviewers Can Audit Strong Coding Agents18arxiv.org原文 ↗
研究 3 个 coding agent 的 411 条执行标注轨迹和 101 个控制案例,发现审阅模型大小不是可靠质量指标。冻结两种证据格式后,6 个审阅器有 5 个在 122 条留出轨迹上同时提高缺陷捕获和拒绝控制,2 个做到全量正确;在没有官方测试时,作者改用 patch-caused static error 与“未修改仓库先失败”的生成测试做级联审计。
PACE: Provenance-Aware Capability Enforcement for Tool-Using LLM Agents19arxiv.org原文 ↗
PACE 将执行前最后一道边界设为能力闸门:path confinement 切断可表示的影响路径,效果验证再与认证请求编译出的 authority 对照。论文给出一个重要限制:安全变体与泄漏变体可能产生同一 admission evidence,所以仅做准入审核无法放宽权限,必须在具体 tool call 落地前重新核验。
Agent Evaluation Reliability: More Tasks Won't (Always) Fix An Agent Leaderboard20arxiv.org原文 ↗
作者用 Bayesian 方差分解分析 Holistic Agent Leaderboard 与 Harbor Index 的 22 个基准,把服务于目标结论的 signal 与会改变名次的无关 noise 分开。由此得到的警告是“可重复排序部署系统”不等于“可重复排序底层模型”,排行榜的可靠性要先明确测量对象,盲目加任务并不保证收敛。
开源 / 项目 · Projects
13 项 · 开源 / 项目LDraw Nova21github.com原文 ↗
ldraw-nova 让 agent 以 plan.json 描述部件、子模型和几何,再生成 Python generator 产出 LDraw MPD;渲染、碰撞/间隙检查和示例库形成闭环。Docker web app 还能导出 3D/VR 视图、glTF 和对话记录,但 README 承认大型正确模型仍依赖高端模型且生成较慢,语义重排不可用时只能退回全文检索。
Bolo Formalization22github.com原文 ↗
项目把《From Linearity to Borrowing》逐节翻译成 Lean 4 定义、定理与证明,`Paper/INDEX.md` 对应论文每个编号结果。已机械化 Fundamental Property,并从类型推导证明闭合程序能从空内存运行到 `unit`;仓库还明确标出哪些证明是对原论文补写或对语义定义的修订。
Kokoallovero23github.com原文 ↗
这是面向 CPU 的独立 C++ Kokoro-82M TTS 引擎,输入文本、输出 24 kHz 音频,单二进制不需要 Python、espeak 或运行时下载,SIMD 由 Highway 运行时派发。README 的 6.6 秒 `af_heart` 测试在 i7-14700F 与 i7-7700 上都约为 PyTorch 的 1.95 倍速度,并提供约 350 MB 资产嵌入和静态链接选项。
DynamicTune26github.com原文 ↗
DynamicTune 把教师隐藏轨迹视为表示空间中的信息速度场,以局部正交 Procrustes 对齐并直接闭式修改学生 MLP 权重,省掉反向传播和训练数据管线。跨 Qwen3.5 4B→0.8B、GPT-2 XL→small 的测试显示,只改 0、7、15、23 层可使多域 held-out NLL 降 10.8%;全 24 层修改会让 NLL 增 64.78%,说明选择编辑位置本身是主要算法问题。
UseJunction27github.com原文 ↗
UseJunction 面向工程与平台团队汇总 Cursor、Claude Code、Codex、Copilot、Ollama 等工具的用量、费用、延迟、计划上限、闲置席位和设备覆盖。它区分供应商已报账的 verified usage 与本地扫描/费率卡估算,不采用键盘记录或全网拦截;README 列出的 macOS/Windows 组合已在真实机器验证。
Zig v0.17.031ziglang.org原文 ↗
release-notes 页面本次抓取受限,digest 将其归为编译器、标准库和工具链变更。同期开发说明已明确 build 系统方向:把 `build.zig` 配置与 runner 分开并缓存序列化配置,减少每次 `zig build` 重跑配置的成本,同时改变脚本读取命令行参数的兼容边界。
行业动态 · Industry News
12 项 · 行业动态Supabase is acquiring Turso32supabase.com原文 ↗
Supabase 宣布收购 Turso,公开口径是继续以 Postgres 为主、让 Turso 延续 SQLite,同时共同解决 agent 大量创建轻量数据库的基础设施问题。公告给出的规模信号是 Supabase 每周已启动超过一百万个数据库,收购逻辑因此更接近“按 agent/任务隔离的数据库供给”而非单纯产品线合并。
Power approval set to delay Oracle's Wisconsin AI datacenter33theregister.com原文 ↗
报道称 Oracle 威斯康星 AI 数据中心要等州监管者批准超过 20 亿美元的输电建设才能接入电力,市场基准把满功率时间推到 2028 年 10 月。这个时间点晚于 2027 年下半年交付目标,显示 AI 基础设施的关键约束已从 GPU 采购延伸到电网审批和送电测试窗口。
Mozilla shutting down Solo AI website creator34support.soloist.ai原文 ↗
Solo 支持页给出的硬截止日期是 2026 年 11 月 30 日,届时站点、账户和数据全部删除且不可恢复。迁移包只含 HTML、图片链接 CSV、联系表单和 newsletter 提交,原图须逐张下载;活跃 Pro/Grow 订阅按 10 月 1 日比例退款,域名则转往 Name.com。
Updates to Full Disk Access in macOS35developer.apple.com原文 ↗
Apple 承认 Full Disk Access 为备份软件提供便利,却可能让应用无感读取文件、邮件、消息、浏览历史并波及通信对象。后续系统会要求更明确的用户动作才能授予这一权限,公告把自主 AI agent 直接列为风险上升的理由,权限 UX 将成为 agent 产品设计的一部分。
GrapheneOS has fixed the Android 17 QPR1 kernel performance regression36discuss.grapheneos.org原文 ↗
GrapheneOS 修复了 Android 17 QPR1 Pixel driver tree 在内存压力下造成的卡顿、冻结和 stall-kill,并公开对应内核提交。项目还在尝试减少 secure spawning 的内存开销,计划在 2026 年 11 月前评估发布;事件反映第三方系统需要自行承担上游回归的测试与交付节奏。
DeepSeek Harness Desktop for macOS and Windows37deepseek.com原文 ↗
DeepSeek Harness 进入全球 public preview,以 Cordis 的插件化架构把桌面应用、Web UI、工具、技能和界面组件拆开。官方示例从文档、数据分析、编码到后台脚本和定时任务,开发者可用 `npx @deepseek-ai/dsh web` 启动并通过 Creator mode 生成插件,生态 API 仍处于演进期。
Cloudflare K2: serverless event streams38blog.cloudflare.com原文 ↗
K2 在 public beta 中提供带长期保留的有序事件日志,让生产者与消费者按各自速度解耦,并支持分片消费或广播。其实现把分区 durable log 放在 R2 上,利用对象存储的一致性和复制能力来适应 Cloudflare 横跨 335 多座城市、节点短暂且网络跨公网的边缘条件。
Chatham scales its capital markets expertise with OpenAI39openai.com原文 ↗
Chatham 将 Codex 放入 Onyx 的计划、开发、测试、文档和审阅环节,并让 ChatFIN 从历史市场数据提取模式、解释组合和链接债务/衍生品/租赁条款。平台同时使用 GPT-5.6 Sol、Terra、GPT-5.4 和 GPT-4.1 按成本与复杂度路由,保留顾问对例外和客户交付的最终判断。
A model guide for the GPT-6 family40openai.com原文 ↗
OpenAI 将 Astra、Sol 和 Luna 按推理难度、复杂编码/研究与规模化重复任务分层,并建议把 reasoning effort 作为可调资源而非固定模型属性。指南给出工程化数字:prompt caching 的输入成本最高可降 95%,长期工作还应结合 compaction、并行工具和 mid-turn steering,再以每个成功任务的质量、延迟、成本做验收。
Memory executives expect RAM shortage to continue through 202841arstechnica.com原文 ↗
Ars 引述 Micron CEO 称 2027 年约 75% 内存产量已被预订,AI 所需 HBM 和服务器 DRAM 正挤占消费电子供给。即便 2028 年新增 clean room,晶圆爬坡、HBM 代际转换和每片晶圆收益下降仍会拖慢平衡,短期价格压力并非只来自单一厂商扩产不足。
F.02 Decommission42figure.ai原文 ↗
Figure 为给 F.03 和 F.04 释放工程资源,选择将含定制执行器与知识产权的 F.02 机队退役;拆解每台会拖慢下一代发布,于是把大部分机体送到芬兰 75 吨电弧炉熔化。团队在 24 小时、六次熔炼窗口内训练模型让机器人自主跳入钢水,回收金属将制成限量纪念品,少数机体留存总部。
Our Project Suncatcher prototype satellite is in orbit43blog.google原文 ↗
Google 与 Planet 合作的 Suncatcher 原型搭乘 SpaceX Transporter-18 入轨,团队已确认通信与正常运行。接下来数周的实验重点不是展示算力,而是测量 TPU 经受发射振动、辐射和热循环后的行为,为可扩展轨道机器学习基础设施提供第一手工程数据。
博客文章 · Blog Posts
12 项 · 博客文章Everyone's Packing Up45widdershins.verja.net原文 ↗
作者把 Reddit、WordPress、Discord、GitHub、Codeberg 和小型 web 服务的迁移/关闭叙事放在一起,原因包括涨价、AI 训练、换东家与政策偏离用户。迁移目的地常是个人站、自托管或 Gopher/Gemini:牺牲可发现性换控制权,说明“平台还在”与“社区创造力仍在平台内”已不是同一件事。
The Four Horsemen of Agentic Coding46distantprovince.substack.com原文 ↗
文章把 agentic coding 的风险命名为 slop、疏离、技能退化和团队关系瓦解,关注的是工作结构而非单次代码正确率。它指出 prompt 操作会把维护、诊断和审美判断推到代码产出之后,短期产能指标可能掩盖长期无人理解系统的成本;正文主要是诊断,尚未提供可验证的治理处方。
The death of web development education47molily.de原文 ↗
文章汇总多位 Web 教育者的收入变化:Axel Rauschmayer 称书籍收入从 2024 年可谋生降至 2026 年为零,Josh Comeau 报告课程收入下降超过一半;同时 AI crawler 让免费内容流量上升却不带来广告收入。作者把问题归因于知识被集中抽取和商品化,主张为教育者建立新的付费与独立社区机制。
Using Opus 5.5 to discover a new eyewitness record of the dodo48resobscura.substack.com原文 ↗
这篇实践记录不是让模型生成历史叙事,而是让 Opus 5.5 在分散史料中检索、聚类和排序渡渡鸟目击线索,再回到原始文献核对出处。流程的技术看点在证据链分工:模型扩大档案搜索面,人负责确认年代、来源和“新发现”是否只是重复整理。
Meta's Muse is fantastic for web scraping49sigh.dev原文 ↗
作者让 Muse 用自然语言编排跨站抓取,例如扫描 Reddit/YouTube 找 1,000 个视频,或遍历 Coachella 艺术家再逐人查询演出。文章的实际价值在于展示多步筛选、分页和结果汇总如何被统一成一个 agent 任务,同时也把 Amazon 等大规模抓取的速率、条款和合规边界留作未解问题。
Git 3.0's upcoming SHA-256 default will be a costly mistake50blog.gitbutler.com原文 ↗
Scott Chacon 认为 SHA-256 默认化把理论碰撞风险转成全生态迁移负担:SHA-1/SHA-256 仓库不能混用,子模块、签名、旧链接和大量非核心 Git 库都要同步改造。文章举例现有仓库转换会重写每个对象并打断协作,主张把信任放在来源认证、签名和分发渠道,而不是强迫所有项目为极少见的攻击模型付费。
Advice to a beginning software engineer51seangoedecke.com原文 ↗
作者给初级工程师的中心建议是友善、负责、真正理解系统,并依据现实议价能力选择何时发起冲突。对 AI 的态度是双重的:不要拒绝公司会要求使用的工具,也不要把判断交给模型;“先追问到自己理解,再决定是否采纳”被视为保持技术成长的最低线。
Frog and Toad and the Increasingly Capable Machines52frogandtoad.ai原文 ↗
这套短篇图文借 Frog and Toad 的儿童故事语气解释 Hugging Face、METR 与能力增强机器,目标是让非技术家人进入讨论。读者一方面认可低门槛叙事,另一方面指出标点错误及拟人化说教可能造成反效果,恰好说明 AI 科普不仅是简化事实,还要处理受众尊重和风格模仿边界。
The hidden design compromises of Docker layers53loige.co原文 ↗
文章借 SOCI 的 seekable index 和 lazy loading 重新拆解 Docker layer:层是依次应用的 tar 归档,删除旧文件依赖 whiteout,历史数据仍占存储。由此可见压缩、按需取文件、缓存复用和启动速度互相牵制,镜像优化不能只看最终 filesystem 大小。
Keeping Futhark off the GPU54futhark-lang.org原文 ↗
Futhark 用 `#[cpu_function]` 把图着色等顺序函数固定到 CPU,同时让同一程序的并行 map 留在 GPU;输入和中间数组在 CPU,返回 GPU 前做一次批量复制。作者承认这是带尖角的临时 hack,但它避免了循环内逐元素迁移,并为未来按数据依赖自动推断内存空间保留接口。
The forgetful CPU (Linux on M4)55yuka.dev原文 ↗
M4 首次强制 SPTM,破坏了 Asahi 过去依靠 m1n1 捕获 macOS MMIO trace 的 bring-up 路径;raw boot 还会因 GXF 被锁和 RVBAR 写入触发崩溃。作者通过跳过这些初始化、关闭严格启动安全并接入串口逐步启动 Linux,案例展示硬件安全机制如何把“支持新芯片”从驱动移植变成引导链逆向工程。
GitHub 热门 · GitHub Trending
0 项 · GitHub 热门引用来源 · References
55 条 · 引用- 1 Agents Are Systems, Not Models: Rethinking Agentic Evaluation. arXiv:2610.01618https://arxiv.org/abs/2610.01618 ↩ 回到正文 · back to text
- 2 Heavy-Tailed Memory Traces in Long-Horizon Language Agents. arXiv:2610.00010https://arxiv.org/abs/2610.00010 ↩ 回到正文 · back to text
- 3 Fault-Tolerant Budget Conservation in Distributed Multi-Agent Delegation. arXiv:2610.00349https://arxiv.org/abs/2610.00349 ↩ 回到正文 · back to text
- 4 pi podhttps://pipod.dev/ ↩ 回到正文 · back to text
- 5 Spenshttps://spens.refwd.ai/ ↩ 回到正文 · back to text
- 6 When Do Causal World Models Help Modular LLM Agents. arXiv:2610.00012https://arxiv.org/abs/2610.00012 ↩ 回到正文 · back to text
- 7 From Proposal to Verified Effect: Praxa, an Evidence-Bound Harness for Governed AI Agent Execution. arXiv:2610.00015https://arxiv.org/abs/2610.00015 ↩ 回到正文 · back to text
- 8 Measuring the Microtask Eligibility Gap: When Is an Off-the-Shelf SLM Enough for an Agent Harness? arXiv:2610.00025https://arxiv.org/abs/2610.00025 ↩ 回到正文 · back to text
- 9 What Should an Agent Remember? Disentangling Retention from Retrieval in Bounded-Memory Evaluation. arXiv:2610.00366https://arxiv.org/abs/2610.00366 ↩ 回到正文 · back to text
- 10 When Harnesses Lose the Signal: Causal Evaluation of Recovery in LLM Agents. arXiv:2610.00372https://arxiv.org/abs/2610.00372 ↩ 回到正文 · back to text
- 11 ReLiveGym: Evaluating Long-Lived Agents over Weeks of Replayed Reality. arXiv:2610.00710https://arxiv.org/abs/2610.00710 ↩ 回到正文 · back to text
- 12 ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization. arXiv:2610.00906https://arxiv.org/abs/2610.00906 ↩ 回到正文 · back to text
- 13 Finding the Right Fit: Model-Harness Interactions across Agent Tasks. arXiv:2610.00917https://arxiv.org/abs/2610.00917 ↩ 回到正文 · back to text
- 14 VeriHarness: Scaling Agentic Verification for Long-Horizon Tasks. arXiv:2610.00972https://arxiv.org/abs/2610.00972 ↩ 回到正文 · back to text
- 15 Learning to Ask: Information Acquisition for SLM-LLM Collaboration, under a budget. arXiv:2610.01236https://arxiv.org/abs/2610.01236 ↩ 回到正文 · back to text
- 16 Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States. arXiv:2610.01415https://arxiv.org/abs/2610.01415 ↩ 回到正文 · back to text
- 17 MemFit: Efficient Long-Term Agentic Memory. arXiv:2610.00872https://arxiv.org/abs/2610.00872 ↩ 回到正文 · back to text
- 18 Groundability, Not Scale Alone: When Weak Reviewers Can Audit Strong Coding Agents. arXiv:2610.01023https://arxiv.org/abs/2610.01023 ↩ 回到正文 · back to text
- 19 PACE: Provenance-Aware Capability Enforcement for Tool-Using LLM Agents. arXiv:2610.01349https://arxiv.org/abs/2610.01349 ↩ 回到正文 · back to text
- 20 Agent Evaluation Reliability: More Tasks Won't (Always) Fix An Agent Leaderboard. arXiv:2610.00651https://arxiv.org/abs/2610.00651 ↩ 回到正文 · back to text
- 21 LDraw Novahttps://github.com/anteloc/ldraw-nova ↩ 回到正文 · back to text
- 22 Bolo Formalizationhttps://github.com/empath-nirvana/bolo-formalization ↩ 回到正文 · back to text
- 23 Kokoalloverohttps://github.com/RobViren/kokoallovero ↩ 回到正文 · back to text
- 24 Gitorangehttps://github.com/choyiny/gitorange ↩ 回到正文 · back to text
- 25 Enkihttps://github.com/enkiruntime/enki ↩ 回到正文 · back to text
- 26 DynamicTunehttps://github.com/dsadawq3/DynamicTune ↩ 回到正文 · back to text
- 27 UseJunctionhttps://github.com/use-junction/usejunction ↩ 回到正文 · back to text
- 28 Agent-SDK-gohttps://github.com/agenticenv/agent-sdk-go ↩ 回到正文 · back to text
- 29 Graphenehttps://github.com/graphene-data/graphene ↩ 回到正文 · back to text
- 30 Pyxelhttps://github.com/kitao/pyxel ↩ 回到正文 · back to text
- 31 Zig v0.17.0https://ziglang.org/download/0.17.0/release-notes.html ↩ 回到正文 · back to text
- 32 Supabase is acquiring Tursohttps://supabase.com/blog/supabase-is-acquiring-turso ↩ 回到正文 · back to text
- 33 Power approval set to delay Oracle's Wisconsin AI datacenterhttps://www.theregister.com/on-prem/2026/10/02/power-approval-set-to-delay-oracles-wisconsin-ai-datacenter/5300832 ↩ 回到正文 · back to text
- 34 Mozilla shutting down Solo AI website creatorhttps://support.soloist.ai/doc/solo-shutdown-faq ↩ 回到正文 · back to text
- 35 Updates to Full Disk Access in macOShttps://developer.apple.com/news/?id=p6zjojqw ↩ 回到正文 · back to text
- 36 GrapheneOS has fixed the Android 17 QPR1 kernel performance regressionhttps://discuss.grapheneos.org/d/42511-grapheneos-has-fixed-the-massive-android-17-qpr1-kernel-performance-regression ↩ 回到正文 · back to text
- 37 DeepSeek Harness Desktop for macOS and Windowshttps://www.deepseek.com/en/harness/ ↩ 回到正文 · back to text
- 38 Cloudflare K2: serverless event streamshttps://blog.cloudflare.com/cloudflare-k2-streams/ ↩ 回到正文 · back to text
- 39 Chatham scales its capital markets expertise with OpenAIhttps://openai.com/index/chatham-financial ↩ 回到正文 · back to text
- 40 A model guide for the GPT-6 familyhttps://openai.com/index/practical-guide-building-gpt-6 ↩ 回到正文 · back to text
- 41 Memory executives expect RAM shortage to continue through 2028https://arstechnica.com/information-technology/2026/10/memory-supplies-are-only-getting-tighter-micron-ceo-says/ ↩ 回到正文 · back to text
- 42 F.02 Decommissionhttps://www.figure.ai/news/f-02-decommission ↩ 回到正文 · back to text
- 43 Our Project Suncatcher prototype satellite is in orbithttps://blog.google/innovation-and-ai/models-and-research/google-research/project-suncatcher-prototype/ ↩ 回到正文 · back to text
- 44 The Harness Is the Companyhttps://blog.sshh.io/p/the-harness-is-the-company ↩ 回到正文 · back to text
- 45 Everyone's Packing Uphttps://widdershins.verja.net/everyones-packing-up/ ↩ 回到正文 · back to text
- 46 The Four Horsemen of Agentic Codinghttps://distantprovince.substack.com/p/the-four-horsemen-of-agentic-coding ↩ 回到正文 · back to text
- 47 The death of web development educationhttps://molily.de/web-dev-education/ ↩ 回到正文 · back to text
- 48 Using Opus 5.5 to discover a new eyewitness record of the dodohttps://resobscura.substack.com/p/using-opus-55-to-discover-a-new-eyewitness ↩ 回到正文 · back to text
- 49 Meta's Muse is fantastic for web scrapinghttps://sigh.dev/posts/metas-muse-is-fantastic-for-web-scraping/ ↩ 回到正文 · back to text
- 50 Git 3.0's upcoming SHA-256 default will be a costly mistakehttps://blog.gitbutler.com/git-3-sha-256 ↩ 回到正文 · back to text
- 51 Advice to a beginning software engineerhttps://www.seangoedecke.com/advice-to-a-beginning-software-engineer/ ↩ 回到正文 · back to text
- 52 Frog and Toad and the Increasingly Capable Machineshttps://www.frogandtoad.ai/ ↩ 回到正文 · back to text
- 53 The hidden design compromises of Docker layershttps://loige.co/hidden-design-compromises-of-docker-layers/ ↩ 回到正文 · back to text
- 54 Keeping Futhark off the GPUhttps://futhark-lang.org/blog/2026-10-02-cpu_function.html ↩ 回到正文 · back to text
- 55 The forgetful CPU (Linux on M4)https://yuka.dev/blog-2026-10-02-linux-m4.html ↩ 回到正文 · back to text