每日 Harness 开源 · Source
全部刊期 · All issues

每日 Harness

2026-08-30 · Sunday, August 30, 2026

大模型基础设施与代理协作升级

视图 · View

今日重点 · Today's Highlights

MoE-Direct2 - 以 NVMe 按需流式加载稀疏专家,使 32GB 内存桌面能够运行 122B 级 MoE,且不改权重和路由。

全文 ↓

vLLM v0.28.03 - 该版本把稀疏模型、投机解码、分层 KV offload 与 Rust/gRPC serving 的优化集中到一次 584-commit 发布中。

全文 ↓

Rysh4 - Go 终端复用器让每个 pane 同时成为可调用工具的 agent,并用 daemon 持久化多代理会话。

全文 ↓

vphone-cli5 - 研究型命令行工具将 Apple 虚拟化、DFU 恢复和 CFW 安装串成一条可重跑的虚拟 iPhone 管线。

全文 ↓

论文 · Papers

0 项 · 论文

开源 / 项目 · Projects

12 项 · 开源 / 项目

Experiential6github.com原文 ↗

github.com

Experiential 把 hosted、BYOK、本地和自定义模型放在一个 OpenAI-compatible gateway 后面,再以用户、agent、用例和预算做授权。首次启动的向导会持久化 provider 连接、创建 public alias 和一次性 key,并将命令预算默认显示为 $50;它的重点是把“能调哪个模型”变成可审计的控制面。

–

Documentation.ai.md7github.com原文 ↗

github.com

AI Docs Standard 提议每个产品同时服务人类读者与 agent 读者,用 `documentation.ai.md` 明写端口、环境变量、参数和响应形状。仓库只用 4 个提交就给出 SPEC、Manifesto 和可复制模板,和 `llms.txt` 的关系是互补而非替代,体现了 machine-first 文档正在成为接口契约的一部分。

–

InferenceFS8github.com原文 ↗

github.com

InferenceFS 把 πfs 的“由元数据定位数据”改写成一则关于模型潜空间的实验:磁盘只保留文件名,内容由训练过互联网的 LLM 推断。README 声称可用 kilobytes 的名字代表 terabytes 数据,但这种设定缺少可验证的字节一致性,恰好把参数记忆与持久化存储的边界暴露出来。

–

OpenTIE and OpenXWA9github.com原文 ↗

github.com

OpenTIE 用原生代码在现代 Windows、macOS、Linux 上运行 1995/1998 两版 TIE Fighter 的原始数据,并允许分别选择菜单、飞行模拟、3D 资产和 iMUSE 音乐。它不携带任何商业游戏内容,用户必须提供至少一版安装,这种数据与引擎分离让重实现兼容性和版权责任都更清晰。

–

StemDeck10github.com原文 ↗

github.com

StemDeck 在本地把 MP3、WAV、FLAC、OGG/Opus、MP4 或 M4A 拆成最多六条 stem,再提供静音、独奏、波形缩放、循环和混音导出。它把“无上传、无账号、无配额”落实为处理路径而非营销口号,并明确 YouTube 入口只是处理用户有权使用的内容。

–

oh-my-subagents11github.com原文 ↗

github.com

Oh My Subagents 将委派建模为持久化 Wave/Assignment/Checkpoint/Result:控制器记录父任务等待,只有负责人接受的结果才算完成,浏览器关闭或 provider 中断不会伪造成功。初始化会发布 8 个可复用 Starter workflow,SQLite 默认且支持 Python 3.12+ 的本地服务,说明它把多代理可靠性问题放在运行时状态而非聊天记录里解决。

–

Tokensift12github.com原文 ↗

github.com

Tokensift 直接用 provider tokenizer 分析 prompt、Message 数组和工具 schema,能指出重复指令、UUID 或未压缩 JSON 的精确 token 成本。项目目前已有 20 条规则、CLI 和 Vitest/Jest matcher;OpenAI 计数是 exact,Claude 因没有公开 tokenizer 只能返回标注为 estimate 的校准值,这个边界比统一报一个“节省百分比”更可信。

–

Itsuki13itsuki.app原文 ↗

itsuki.app

Itsuki 将对话、文档和事件抽取为带来源的 fact、event、entity、relationship,再让 Claude、Codex、Cursor、LangChain 等工具共用一份可更新记忆。页面示例把 18 轮对话压成 4 个持久对象并丢弃 14 行闲聊,同时保留原句和版本;这种结构化压缩解决的是可追溯性,而不只是把旧 transcript 再塞回上下文。

–

sqlite-diff-log14github.com原文 ↗

github.com

sqlite-diff-log 在数据库内安装 `AFTER` trigger,自动将 INSERT、UPDATE、DELETE 写成 old/new JSON diff,调用方不需要 ORM 或改表。因为逻辑位于 SQLite C 核心,Python、Node、Go 甚至 sqlite3 CLI 的写入都会被覆盖;标识符校验、标准库零依赖和 Litestream 复制兼容使它适合嵌入式审计场景。

–

Darwin-VM15github.com原文 ↗

github.com

Darwin-VM 用 QEMU 启动可调试的 iOS/macOS Darwin,支持 iPhone 12 - 17 与 M1 - M5 Mac,能进入 root shell、改 root filesystem 并调试 kernel、SPTM、dyld 和 launchd。它不要求 ARM 主机,仓库还给出自动化 `run.sh` 和内核启动日志;价值在于把通常依赖真机或越狱的低层实验搬进可重复的虚拟环境。

–

Kosh16github.com原文 ↗

github.com

Koshka 是 Bash 5.3/Dash 兼容的 shell、formatter 与 LSP,目标是在三种桌面系统上同时替代 Bash 和 Shellcheck。README 报告约 300 条内置诊断、20K 行脚本约 0.05 秒完成分析,速度约为 Bash 的 5 倍、Shellcheck 的 100 倍以上;静态 Linux 二进制和自带 utilities 也减少了 agent 沙箱的环境依赖。

–

AgentBridge17github.com原文 ↗

github.com

AgentBridge 用只读 MCP 接口让 Brain agent 检查代码库、理解架构和写计划,再把 C2C plan 交给本地 Executor 编辑文件、运行命令和测试。它把推理配额与执行权限明确隔离,当前示例用 Rust 实现并以 OpenCode 做执行端,适合需要强推理模型但又要保留本地工作区控制的流程。

–

行业动态 · Industry News

9 项 · 行业动态

Tencent Hy4 Preview18tencent.com原文 ↗

tencent.com

腾讯开源 Hy4 preview,规格为 770B 总参数、49B active parameters、超过 1M tokens 上下文;内部 163 位专家在 203 个工程任务上的盲测平均 2.99/4,高于 GLM-5.3 的 2.92 和 Kimi K3 的 2.94。更值得核对的是工程化指标:模型参与训练和推理优化后,端到端吞吐相对基线提升 31.8%,API 价格则为输入 $0.834/M、输出 $2.501/M tokens。

–

Warp builds self-improving agents on Claude19claude.com原文 ↗

claude.com

Warp 把反馈闭环拆成执行任务的 inner skill 与定期修改它的 outer improver,后者从 issue/PR 的人类评论提炼最小变更,再走正常代码审查。示例中 GitHub Action 发现 triage agent 漏打“ready to spec”标签,改进 agent 只更新一条规则;Warp 同时披露 80 万月活开发者和累计 1000 万次 Claude Code 会话,显示这种方法已被放进高频工作流。

–

Pixel 11 no longer supports hardware memory tagging20bsky.app原文 ↗

bsky.app

GrapheneOS 项目称 Pixel 11 不再支持硬件内存标记(MTE)。这意味着依赖硬件 tag 检查越界与 use-after-free 的安全加固路径可能被平台产品线收回,争议焦点从系统软件配置转向芯片与设备策略。

–

Our decision on Cursor following its acquisition by SpaceX21openai.com原文 ↗

openai.com

OpenAI 计划在 2026 年 11 月 12 日停止向被 SpaceX 收购后的 Cursor 提供模型,并称会按合同给出最长通知期。声明把决定归因于对 SpaceX 遵守服务条款缺乏信心,引用 Twitter 与 xAI 的既有违约经历,同时表示近四年的合作和开发者迁移会得到支持。

–

Debian votes to allow “responsible use of generative AI”22lwn.net原文 ↗

lwn.net

LWN 概述 Debian 开发者投票采取“负责任使用生成式 AI”的立场,既不背书也不全面禁止。这个治理选项把贡献者自主权、审查负担和生成内容风险交给项目规则协商,而不是用一个全局开关替代维护者判断。

–

EPA permitting guidance for data centers23epa.gov原文 ↗

epa.gov

EPA 解释未接入公共电网的 islanded 发电设施不适用 Clean Air Act Acid Rain Program,因为它们不售电且无需向 DOE 报告;日后并网则可能重新纳入。配套的 Ratepayer Protection Pledge 要求企业承担为数据中心供能及建设支持基础设施的全部成本,政策实质是把算力扩张的电力外部性转成开发商责任。

–

Sovereign Tech Agency invests €500k in Flatpak24modal.cx原文 ↗

modal.cx

德国 Sovereign Tech Agency 为 Flatpak 投入 €508,640、周期两年并预计持续到 2027 年底,目标是补齐桌面 Linux 沙箱的基础设施。路线图包含 PipeWire 音频权限、网络范围/端口隔离、VPN、拼写和密码自动填充 portal,以及 entitlements、intents 和集成测试;文章同时承认现有网络与 VPN portal 仍有缺口。

–

DHS is using obscure law to snoop on journalists25theguardian.com原文 ↗

theguardian.com

《卫报》称 DHS 以第 1509 条行政传票向平台索取批评 ICE 的用户身份,并追查记者、工会和非营利组织的财务记录,过程通常没有法官审查也不要求通知用户。Google 曾因请求未证明与海关调查有关而拒绝,报道还回顾 2017 年监察长认定这项传票权限存在“不一致和不当”使用。

–

US Government designates host of noblogs.org a “global terrorist”26crimethinc.com原文 ↗

crimethinc.com

CrimethInc. 报道美国把托管 noblogs.org 的意大利集体 Autistici/Inventati 列入“全球恐怖组织”,并质疑国务院将加密工具、Rose City Antifa 与 Hamas/IRGC 的关联建立在错误归因上。财政部通知称 2026 年 9 月 25 日起交易受全球恐怖主义制裁规则限制,而该集体则把自身定位为提供数字自卫和自由通信的基础设施。

–

博客文章 · Blog Posts

15 项 · 博客文章

Samsung’s Processing-in-Memory (PIM)27chipsandcheese.com原文 ↗

chipsandcheese.com

三星把 PIM MAC 阵列放入 LPDDR5X 的 16 个 bank,用特殊行地址切换 multi-bank 与寄存器访问,内部带宽可达 614GB/s,普通 DRAM 访问约 76.8GB/s,4-bit 权重峰值约 2.4 TOPS。文章的关键判断不是峰值数字,而是系统代价:PIM 读写带副作用,会绕过 cache、预取和乱序执行,软件只能划不可缓存区域并阻塞并发;要真正普及仍需一致性协议和内存控制器配合。

–

The internet is kind of a predatory cesspit now28stephendiehl.com原文 ↗

stephendiehl.com

Stephen Diehl 把平台商业模型描述为“检测脆弱性、优化刺激、处理付款、推荐下一次转化”的强化学习回路,恐惧、孤独和身份焦虑因此成为可重复售卖的库存。文章进一步推断 LLM 会把制造可信谎言的边际成本压到近零;它提出的现实对策不是怀旧,而是给无限 feed 加上像邮件、书本那样的使用边界。

–

LLMs are making me lose my savviness29pgaleone.eu原文 ↗

pgaleone.eu

作者记录依赖 LLM 后判断力和解决问题熟练度的变化,焦点在“答案更快”与“能力是否仍在自己身上”的张力。条目没有把退化归咎于某个模型版本,而是提醒长期使用者保留人工推理、验证和脱离工具完成任务的时段。

–

Domain-Driven Agents30coldtake.dev原文 ↗

coldtake.dev

文章把 DDD 的 bounded context 与 ubiquitous language 变成 agent 的工作资料:人负责战略和边界,agent 负责战术实现,每个仓库用 `.workflow.json` 和 `CONTEXT.md` 保存事实来源。生成器跨仓库交叉引用清单,发现术语或接口不一致便自动开 GitHub issue,重点由“让模型猜架构”转为“让模型消费显式领域模型”。

–

I accidentally turned LLM memory into program analysis31pwning.systems原文 ↗

pwning.systems

Lemmalog 让 LLM 把自然语言和调试观察抽成事实,再用 Datalog 做规则推导、撤回、时间区间和 provenance,因此一条被推翻的观察会自动使下游结论失效。LongMemEval 的三次运行 F1 为 0.463±0.010(full context 为 0.222),回答上下文约缩小 38 倍;LoCoMo 得分 0.533,低于 PropMem,说明实体抽取和模糊推理仍不能交给符号层。

–

Calibrate Before You Accelerate: Bias Toward Action in a New Role32tucker.wales原文 ↗

tucker.wales

文章把入职后的行动分为收集、综合、加速三阶段:先画利益相关者和历史决策,再聚合重复痛点、区分低风险小胜与系统问题,最后用公开的小改进和一页纸假设推进。建议工作比重从约 90% 倾听/10% 执行逐步切到 20%/80%,用 Chesterton's Fence 防止不了解承重结构就拆掉旧流程。

–

Good Culture Is the Biggest Productivity Hack, Not AI33newsletter.eng-leadership.com原文 ↗

newsletter.eng-leadership.com

Gregor Ojstersek 以工程管理经验说明 AI 会放大组织已有的沟通、架构和信任问题,心理安全、清晰责任和可质疑领导才是生产力前置条件。文章列出 10 个自检问题,并反对用“AI 让团队少用人或效率 10 倍”施压,主张从团队自下而上试用工具,把结果而非使用次数作为目标。

–

The growing divide between AI hype and software engineering reality34optimizedbyotto.com原文 ↗

optimizedbyotto.com

文章引用对 120 个开源项目的政策审查,其中 37 个全面禁止 AI,Linux kernel 要求披露模型,GCC、QEMU、Gentoo、Zig 等拒收 AI 辅助贡献。作者把冲突解释为信息不对称:新手提交看似专业却需大量核验的内容,维护者承担时间成本;文中同时提醒 SWE-bench 仍约 77%,专家估计至少三分之一生成结果错误或有害。

–

A better SQL in 11 lines of code35prela-lang.org原文 ↗

prela-lang.org

Prela 将表拆为二元关系,用 `.select()` 做复合、`.with()` 做限制,并把宿主语言变量、闭包和聚合直接纳入查询表达式;查询文本同时就是执行计划,因为系统不替用户重排 join。CPS 实现核心不足 1k 行,基准中 JOB 的 113 条查询用时 5.2s 对 DuckDB 的 15.3s,TPC-H SF=1 优化版为 0.44s,代价是开发者必须自己承担计划控制。

–

Quantifying Colour36ekunazanu.foo原文 ↗

ekunazanu.foo

交互式文章从光谱功率分布和三类视锥细胞出发,以 L、M、S 三个积分量定义颜色,再解释异谱色、色盲和显示器标准化。它把 RGB 的负值问题连接到 CIE XYZ 的 3×3 线性变换:XYZ 的基色是抽象的“虚构”量,却能把光谱颜色放进非负象限,读者可通过滑块直接看到坐标系选择如何改变表示。

–

Parsing the Infamous Japanese Postal CSV37dampfkraft.com原文 ↗

dampfkraft.com

`posuto` 针对日本邮政 `ken_all.csv` 的历史格式异常做预处理:町名超过 38 字符或假名读音超过 76 字符时,一行会被拆成多行并重复字段,断点甚至不遵循词边界。最极端的邮编有 66 行,京都地址连续 8 行;再加上“except the following”括号和失真的罗马字,项目选择输出清洗后的 JSON,而不是假装通用 CSV parser 已经足够。

–

Hilariously fast volume computation with the divergence theorem38alyssarosenzweig.ca原文 ↗

alyssarosenzweig.ca

对简单封闭三角网格,文章选取散度为 1 的 F=(x,0,0),把体积分化为三角面片求和,得到 `V = 1/6 Σ ((Δ1×Δ2)_x)(x0+x1+x2)`。每个三角形只需固定次数的加乘,总复杂度 O(n)、约 11n 次浮点运算;作者还诚实补充该算法与已有论文相同,推导的教学价值高于新颖性。

–

Hunting Down a Go Runtime Bug on 32-Bit Embedded Systems39sigma-star.at原文 ↗

sigma-star.at

32 位 ARM 嵌入式 Linux 上的 Go 程序因 netpoll 假定事件只会是 `EPOLLIN` 而崩溃,问题最终落到 event fd 与 socket fd 的识别和指针标记别名。修复不是业务层重试,而是调整 runtime 的判别方式,案例提醒移植到窄位宽设备时要审查宿主假设、tagged pointer 和 epoll 事件语义的交叉处。

–

Creating the Aetheryte Radio40haz.ee原文 ↗

haz.ee

作者从 FFXIV 资源中定位 `placednpc_ethelight_big_loop.scd/0`,用 SoundFilter 找到 hum/whir,再用 Web Audio API 重建连续环境声。hum 以 -25dB 循环,whir 在 0.794 - 1.0 播放速率、0.6 - 1.0 增益和 0 - 2000ms 间隔中随机选择;用节点生命周期替代固定长音轨,既解决浏览器循环断裂,也隐藏重复感。

–

Just the rumour of a bug is enough to find an exploit these days41anil.recoil.org原文 ↗

anil.recoil.org

修复 OCaml cohttp 路径穿越的公开 PR 后约 10 分钟,作者的线上服务就收到 percent-encoded traversal 探测;他让 agent 只依据漏洞类别,在一分钟内生成了本地 exploit。文章据此主张传统 embargo 已不能买时间,引用 15 漏洞基准中 GPT-4 agent 87% 的成功率,并提出 web-of-trust、连续发布、跨生态扫描和协议层 virtual patching 的组合防线。

–

引用来源 · References

42 条 · 引用
  1. 1 Canonical-basis realignment for Transformer LLMshttps://github.com/todotge/canonical-basis ↩ 回到正文 · back to text
  2. 2 MoE-Directhttps://github.com/tmxkzm1925-max/MoE-Direct ↩ 回到正文 · back to text
  3. 3 vLLM v0.28.0https://github.com/vllm-project/vllm/releases/tag/v0.28.0 ↩ 回到正文 · back to text
  4. 4 Ryshhttps://github.com/rysh-ai/rysh-cli-code ↩ 回到正文 · back to text
  5. 5 vphone-clihttps://github.com/Lakr233/vphone-cli ↩ 回到正文 · back to text
  6. 6 Experientialhttps://github.com/experientiallabs/experiential ↩ 回到正文 · back to text
  7. 7 Documentation.ai.mdhttps://github.com/iwasoftcom/ai-docs-standard ↩ 回到正文 · back to text
  8. 8 InferenceFShttps://github.com/philipl/inferencefs/ ↩ 回到正文 · back to text
  9. 9 OpenTIE and OpenXWAhttps://github.com/elyosh/OpenTIE/ ↩ 回到正文 · back to text
  10. 10 StemDeckhttps://github.com/stemdeckapp/stemdeck ↩ 回到正文 · back to text
  11. 11 oh-my-subagentshttps://github.com/ringlochid/oh-my-subagents ↩ 回到正文 · back to text
  12. 12 Tokensifthttps://github.com/ritenv/tokensift ↩ 回到正文 · back to text
  13. 13 Itsukihttps://itsuki.app/ ↩ 回到正文 · back to text
  14. 14 sqlite-diff-loghttps://github.com/MigMarGil/sqlite-diff-log ↩ 回到正文 · back to text
  15. 15 Darwin-VMhttps://github.com/jprx/darwin-vm ↩ 回到正文 · back to text
  16. 16 Koshhttps://github.com/toiletbril/kosh ↩ 回到正文 · back to text
  17. 17 AgentBridgehttps://github.com/IndexFlowing/AgentBridge ↩ 回到正文 · back to text
  18. 18 Tencent Hy4 Previewhttps://www.tencent.com/tencent-releases-and-open-sources-tencent-hy4-preview/ ↩ 回到正文 · back to text
  19. 19 Warp builds self-improving agents on Claudehttps://claude.com/blog/how-warp-builds-self-improving-agents-on-claude ↩ 回到正文 · back to text
  20. 20 Pixel 11 no longer supports hardware memory tagginghttps://bsky.app/profile/grapheneos.org/post/3mua32q4ds22e ↩ 回到正文 · back to text
  21. 21 Our decision on Cursor following its acquisition by SpaceXhttps://openai.com/index/our-decision-on-cursor-following-its-acquisition-by-spacex/ ↩ 回到正文 · back to text
  22. 22 Debian votes to allow “responsible use of generative AI”https://lwn.net/Articles/1091231/ ↩ 回到正文 · back to text
  23. 23 EPA permitting guidance for data centershttps://www.epa.gov/newsreleases/epa-issues-permitting-guidance-further-president-trumps-agenda-promoting-data-centers ↩ 回到正文 · back to text
  24. 24 Sovereign Tech Agency invests €500k in Flatpakhttps://modal.cx/blog/announcing-flatpak-sta/ ↩ 回到正文 · back to text
  25. 25 DHS is using obscure law to snoop on journalistshttps://www.theguardian.com/us-news/2026/aug/29/trump-dhs-1509-summons-records-journalists-nonprofits ↩ 回到正文 · back to text
  26. 26 US Government designates host of noblogs.org a “global terrorist”https://crimethinc.com/2026/08/27/us-government-designates-host-of-noblogsorg-a-global-terrorist ↩ 回到正文 · back to text
  27. 27 Samsung’s Processing-in-Memory (PIM)https://chipsandcheese.com/p/hot-chips-2026-samsungs-processing ↩ 回到正文 · back to text
  28. 28 The internet is kind of a predatory cesspit nowhttps://www.stephendiehl.com/posts/internet_predatory_cesspit/ ↩ 回到正文 · back to text
  29. 29 LLMs are making me lose my savvinesshttps://pgaleone.eu/ai/2026/08/29/losing-savviness/ ↩ 回到正文 · back to text
  30. 30 Domain-Driven Agentshttps://coldtake.dev/blog/domain-driven-agents ↩ 回到正文 · back to text
  31. 31 I accidentally turned LLM memory into program analysishttps://pwning.systems/posts/llm-memory-program-analysis/ ↩ 回到正文 · back to text
  32. 32 Calibrate Before You Accelerate: Bias Toward Action in a New Rolehttps://tucker.wales/writing/bias-towards-action/ ↩ 回到正文 · back to text
  33. 33 Good Culture Is the Biggest Productivity Hack, Not AIhttps://newsletter.eng-leadership.com/p/good-culture-is-the-biggest-productivity ↩ 回到正文 · back to text
  34. 34 The growing divide between AI hype and software engineering realityhttps://optimizedbyotto.com/post/why-open-source-projects-ban-ai/ ↩ 回到正文 · back to text
  35. 35 A better SQL in 11 lines of codehttps://prela-lang.org/tutorial/ ↩ 回到正文 · back to text
  36. 36 Quantifying Colourhttps://ekunazanu.foo/lab/quantifying-colour/ ↩ 回到正文 · back to text
  37. 37 Parsing the Infamous Japanese Postal CSVhttps://www.dampfkraft.com/posuto.html ↩ 回到正文 · back to text
  38. 38 Hilariously fast volume computation with the divergence theoremhttps://alyssarosenzweig.ca/blog/hilariously-fast-volume-computation-with-the-divergence-theorem.html ↩ 回到正文 · back to text
  39. 39 Hunting Down a Go Runtime Bug on 32-Bit Embedded Systemshttps://sigma-star.at/blog/2026/08/go-runtime-netpoll-bug/ ↩ 回到正文 · back to text
  40. 40 Creating the Aetheryte Radiohttps://haz.ee/posts/aetheryte-radio.html ↩ 回到正文 · back to text
  41. 41 Just the rumour of a bug is enough to find an exploit these dayshttps://anil.recoil.org/notes/rumour-is-the-exploit ↩ 回到正文 · back to text
  42. 42 swoole/typephphttps://github.com/swoole/typephp ↩ 回到正文 · back to text