每日 Harness 开源 · Source
全部刊期 · All issues

每日 Harness

2026-09-09 · Wednesday, September 9, 2026

智能体走向可验可控基础设施

视图 · View

今日重点 · Today's Highlights

[deltafin](https://github.com/argonautlabsai/deltafin)[^2] - 用 SSD 流式权重和草稿模型验证,在消费级 Apple Silicon 上保留完整 2.8T Kimi K3,而不是依赖剪枝近似。

全文 ↓

[nvkvm-pv](https://github.com/reindertpelsma/nvkvm-pv)[^3] - 以 ioctl 半虚拟化代替 VFIO 直通,让客体使用宿主仍在工作的 NVIDIA GPU,触及云桌面与本地实验的隔离边界。

全文 ↓

[vllm-project/agentic-api](https://github.com/vllm-project/agentic-api)[^4] - Rust 网关把会话状态、工具循环和流式 continuation 从客户端搬到 vLLM 前端,形成单次请求驱动的 agent 服务。

全文 ↓

[Archprint](https://github.com/Tommkruix/archprint)[^5] - 从真实 TypeScript import graph 统计推断边界,并只把证据足够强的规则写入现有 lint 工具,避免架构文档与执行脱节。

全文 ↓

论文 · Papers

1 项 · 论文

本期重点C*: Unifying Programming and Verification in C1arxiv.org原文 ↗

arxiv.org

论文提出 proof-integrated 的 C*,让程序员在实现代码旁嵌入 proof-code,符号执行引擎负责状态推进,LCF 风格内核负责可信检查。原型覆盖小型 C 基准,并在 pKVM buddy allocator 的 `attach` 函数上处理复杂推理,说明目标不是只验证玩具循环。把证明和实现共用 C 语法降低了工具切换成本,但论文目前仍是原型和有限案例,离完整 C 生态的工程验证还有距离。

–

开源 / 项目 · Projects

15 项 · 开源 / 项目

本期重点deltafin2github.com原文 ↗

github.com

deltafin 将 Kimi K3 的专家权重放在多块 SSD 上按需读取,用 Rust 单二进制协调 resident spine、专家缓存和 speculative draft。README 报告 M1 Max 最新吞吐 0.2901 token/s;`setup --full` 需约 1.7TB,而 `--stream` 约 215GB 即可起步,完整质量换来的是极低速度和高存储门槛。它更像一项“把基础设施极限压进家用机”的实验,公开的测量脚本让后续优化有可复现基线。

–

LLM Attention Visualization6ishamf.dev原文 ↗

ishamf.dev

这个浏览器可视化器把不同层、不同 attention head 的 token 关联画成可交互连线,输入文本后可逐层观察权重变化。它适合教学、调试 prompt 或做定性可解释性检查,却没有把热图直接包装成因果解释;页面未给统一模型基准,结论应停留在“模型此刻看向哪里”的观察。

–

I-have-ADHD7github.com原文 ↗

github.com

这是给 coding agent 的输出纪律插件,规则包括“先行动”“多步任务编号”“每轮复述状态”和“以一个具体下一步收尾”。示例把认证问题压成命令、三步修改和失败时贴首行日志,十条规则还限制列表最多五项、给分钟级时间估计。它把交互成本当作工程变量,适合嵌入团队 agent 规范;不过压缩表达不能替代复杂任务所需的背景记录。

–

Copperhead8copperhead.sh原文 ↗

copperhead.sh

Copperhead 试图成为“电路板的 Cursor”,把原理图、PCB 布局和 AI 辅助迭代放入同一硬件开发工作流。产品叙事聚焦缩短从想法到可制造设计的周期,核心差异是持续保留硬件上下文,而非一次性生成文件。公开站点尚未给出可复现实验或制造良率数字,因此更适合视为硬件工具链方向的早期信号。

–

本期重点nvkvm-pv3github.com原文 ↗

github.com

nvkvm-pv 在 QEMU/KVM 客体拦截 NVIDIA 驱动 ioctl,再把调用转到宿主驱动,使客体可以运行未修改的 CUDA、PyTorch 和 Vulkan。方案避开 VFIO 独占和 vGPU 许可,同时要求 host/guest 驱动版本协同;“接近宿主性能”是目标而不是已证明的普遍结论。它把 GPU 虚拟化的瓶颈从设备所有权移到了调用协议和隔离策略,实验性状态尤其需要关注崩溃和越权面。

–

Grith9github.com原文 ↗

github.com

Grith 在 Linux syscall 层为 AI agent 加一道运行时监督:低风险文件、进程和网络调用可按策略放行,模糊或高风险动作暂停交人工确认。相比提示词承诺,它观察的是最终副作用,因而能覆盖不同 agent 和 shell 工具;代价是策略必须理解 syscall 语义,还要处理代理并发、子进程和日志回显。

–

本期重点Archprint5github.com原文 ↗

github.com

Archprint 从 TypeScript import graph 挖出仓库已经遵守的循环依赖、测试隔离、公共 API 等边界,并生成 ESLint、dependency-cruiser、ts-arch 配置。统计门槛用 Wilson 下界区分 AUTO、SUGGEST 和 REJECT;项目在 92,861 个公开 TS 仓库上扫描无崩溃,四仓库三轮机械规则审计零误报。结构性层/角色规则仍默认人工复核,这种保守分层是它比“自动写架构规则”更可信的关键。

–

Browser LLM Fit10news.ycombinator.com原文 ↗

news.ycombinator.com

Browser LLM Fit 先探测客户端 CPU、GPU、内存及 WebGPU/WASM/ONNX Runtime 能力,再匹配能在浏览器本地运行的模型。它把模型选择变成设备画像问题,减少下载后才发现显存不足的试错;目前公开讨论没有统一质量和能耗矩阵,推荐结果仍需要在目标设备上复测。

–

DeepMem11github.com原文 ↗

github.com

DeepMem 提供 Mem0 兼容 API,把向量检索、BM25 关键词匹配和时间衰减合成一层 agent memory。项目宣称检索约快 2 倍、成本低 10 倍,迁移可保持调用形状并自托管;这套混合排序同时照顾语义近邻、精确术语和新鲜度。性能数字依赖数据分布与索引维护,真正的判断应放在带时间戳的对话回放上。

–

ChronoVec12github.com原文 ↗

github.com

ChronoVec 把向量记录做成带版本区间的 ANN 索引:查询可回到历史 snapshot,删除通过有预算的 `vacuum` 物理回收,读者在写入时读取不可变视图。公开测试在 20 万 live vectors 的 churn 写入下达到约 140 - 150k replacement-pairs/s,约为 Faiss 的 16.5 倍;静态库查询则慢约 1.5 - 2 倍。它精准服务于持续修订的 RAG、合规删除和 agent 分支推演,而不是一次构建永不变化的语料库。

–

Blackholes13blackholes.dev原文 ↗

blackholes.dev

Blackholes 是 macOS 工作区,把 coding agent、仓库、终端、分支和 worktree 作为可切换的项目单元管理。设计重点是保留每个并行任务的代码与会话上下文,减少窗口和 shell 状态的手工拼接;站点未公开存储格式或性能数据,实际收益取决于它对现有 Git 操作的覆盖程度。

–

Felan14github.com原文 ↗

github.com

Felan 是模型可替换的终端 coding agent,提供模型路由、渐进式上下文、紧凑工具输出和显式任务状态,并估算 token/费用节省。它把工具结果先压缩再回传,按任务把请求分给不同模型,试图让“可验证的软件工作”成为可观测循环。这样的控制面适合多模型部署,但质量仍需在真实仓库里验证,而非只看节省的 token 数。

–

Keyfence15github.com原文 ↗

github.com

Keyfence 作为本地代理拦截 Claude Code、Cursor、Codex 等客户端发往 LLM API 的请求,在离开机器前识别或阻断密钥、环境变量和凭据。上游真正的 API key 只留在代理进程,客户端获得统一出口和审计点;要做到完整防护仍需检查子进程、调试日志及错误回显等旁路,不能只依赖正文正则。

–

Lini16lini.rs原文 ↗

lini.rs

Lini 用 Rust/WASM 和一套声明式语言同时描述图表、流程图、平面图与电路示意图,统一文本输入、布局和浏览器渲染。单一语法便于 Git 版本控制及代码审查,也减少不同图形工具之间的格式转换。主页没有披露与 Mermaid/D2 的速度或表达力比较,项目价值主要在跨图种的一致工作流。

–

TALA Is Open-Source17d2lang.com原文 ↗

d2lang.com

D2 团队开放 TALA 自动布局引擎源码,节点、边与约束的布局逻辑因而可本地检查、部署和扩展。此举让布局算法与 D2 渲染语言的边界更清晰,也为特殊图形贡献规则提供入口;公告没有保证开源版与商业服务的发布节奏或功能完全同步,使用者仍需关注版本治理。

–

行业动态 · Industry News

13 项 · 行业动态

On the Navier - Stokes Millennium Prize Problem18openai.com原文 ↗

openai.com

OpenAI 声称内部多智能体系统构造了受迫三维不可压 Navier - Stokes 有限时间奇点的解析证明,并发布 Lean 形式化;文章描述的涡流向内螺旋、轴向拉伸,速度发散但能量有限。其流程动用了约 10,000 个并发 agent,88 小时产出、再用 17 小时完成 Lean 验证。公司明确不申领千年奖,这个案例真正值得观察的是形式化和外部数学审查能否跟上生成速度。

–

AlphaGenome Atlas19deepmind.google原文 ↗

deepmind.google

Google DeepMind 发布 AlphaGenome Atlas,用序列模型预测人类基因组单碱基替换对调控信号和表达的影响,并将结果组织成可查询地图。覆盖“每一种字母变化”让研究者可以先筛选候选位点,再安排实验验证;预测图应作为实验设计的候选排序,而非直接的致病性结论。

–

ChatGPT Images 2.520openai.com原文 ↗

openai.com

Images 2.5 的更新集中在参考图保真、局部编辑和多轮一致性,官方称延迟较 Images 2.0 最多下降 50%。ChatGPT 加入 Sketch 草图、模板、图像内评论和可分享 prompt,API 则分成速度优先的 Flare 与精细控制的 Sunburst;官方还称相关产品每周生成超过 30 亿张图,并沿用 C2PA/隐形水印。产品差异从“能生成”转向“连续修改不破坏原图”,更贴近生产素材流程。

–

Muse21ai.meta.com原文 ↗

ai.meta.com

Meta 公布个人 AI agent Muse,强调持续理解偏好并在对话、计划和内容处理等任务中主动协助。页面把重点放在与 Meta 产品生态的结合,而非公布模型结构或工具权限;因此当前信号是个人助理的产品形态,安全边界和独立评测仍待补充。

–

Mercury 2.522inceptionlabs.ai原文 ↗

inceptionlabs.ai

Inception Labs 更新 Mercury 2.5,继续押注扩散式语言模型路线,以并行候选和迭代去噪区别于逐 token 解码。公告强调产品线的速度、质量和可用性改进,但未给出参数量或公开基准表;在缺少数字时,最稳妥的判断是技术路线延续,而不是宣称代际领先。

–

Mistral raises €3B23mistral.ai原文 ↗

mistral.ai

Mistral 宣布融资 30 亿欧元,资金将支持主权部署、开放权重模型和前沿基础设施。公告把区域化算力、数据控制和开放权重绑定在同一商业叙事中,回应欧洲在监管与供应链约束下的独立部署需求;金额是已披露事实,具体模型时间表仍需后续版本验证。

–

LG TVs caught spying even when offline or on standby24theverge.com原文 ↗

theverge.com

The Verge 根据 Gamer Nexus 调查称,部分 LG 电视在待机或断网时仍可能记录使用行为并扫描附近 Wi‑Fi。报道把风险指向后台遥测和唤醒逻辑,说明“待机”并不等于物理断电;影响范围取决于机型、固件和设置,用户需要用抓包与厂商说明核对,而不是从单一案例推及全系产品。

–

LibreOffice breaks download records after declaring it has no AI features25manualdousuario.net原文 ↗

manualdousuario.net

报道称 LibreOffice 强调不集成生成式 AI 后下载量创纪录,作者将其解读为用户偏好离线、可控、无云依赖的办公工具。下载峰值同时可能受版本发布和媒体曝光影响,不能单独证明“拒绝 AI”带来因果增长;它提供的是产品定位和信任诉求的市场信号。

–

Leaving VMware just got harder after Broadcom pulled VDDK downloads26virtualizationhowto.com原文 ↗

virtualizationhowto.com

Broadcom 撤下 VMware VDDK 的公开下载入口,影响依赖该开发包进行备份、迁移和虚拟磁盘操作的第三方工具。现有安装不会因此立即失效,但新项目获取兼容组件、复现旧流程及满足供应商支持条件的成本会上升;这把迁移难点从技术转换扩展到软件供应链和合规获取。

–

DaVinci Resolve 21.127blackmagicdesign.com原文 ↗

blackmagicdesign.com

Blackmagic Design 发布 Resolve 21.1,覆盖剪辑、调色、Fusion、Fairlight 音频和交付链路。跨模块更新意味着已有项目应按使用的编解码器、插件和协作流程逐项回归,而不是只看版本号;升级价值在于一次性收拢多个后期环节的修复与改进。

–

FreeBSD 14.5-Release28freebsd.org原文 ↗

freebsd.org

FreeBSD 14.5 是稳定分支的维护版发布,集中汇总内核、网络、驱动、用户空间和安全修复。它的价值在于给 14.x 部署一条累积更新路径,而非改变系统架构;升级前需要核对 errata、硬件支持和 ports 兼容性,尤其是长期运行的服务器。

–

Jellyfin 12.029jellyfin.org原文 ↗

jellyfin.org

自托管媒体服务器 Jellyfin 进入 12.0,涉及服务端 API、媒体库、转码、客户端和用户管理的主版本演进。主版本升级通常意味着数据库迁移和插件兼容风险,管理员应先备份配置并在副本库验证;对长期运行实例而言,迁移和回滚策略与新功能同样关键。

–

How GPT-5.6 Sol helps run quantum computing experiments30openai.com原文 ↗

openai.com

OpenAI 案例介绍 MIT 团队用 Codex 自动编排量子实验、读取测量、分析偏差并调校量子比特参数。代理承担的是重复控制和数据分析闭环,实验设备与安全权限仍在系统边界之外;这类工作流的关键工程问题是可复现日志、仪器授权和人工复核,而非单次生成代码的质量。

–

博客文章 · Blog Posts

13 项 · 博客文章

Statement on finite-time blowup for forced 3D Euler, and OpenAI's conduct31cims.nyu.edu原文 ↗

cims.nyu.edu

Tristan Buckmaster 的声明重申受迫三维 Euler 有限时间爆破结果,并回应 OpenAI 发布 Navier - Stokes“解答”的过程。文中强调 Euler 与含黏性的 Navier - Stokes 是不同方程、不同命题,优先权和署名也应分开讨论;这为解读相邻数学成果提供了必要的术语边界。

–

How well do agents use test/verification techniques?32danluu.com原文 ↗

danluu.com

Dan Luu 在 Rust Zstd 任务上比较 26 种测试/验证提示条件,使用约 160 次运行和隐藏测试通过率衡量效果。没有方法大幅领先,默认条件反而高于平均;代理常写恒真形式化证明、低价值随机测试,TDD 虽让预先失败测试从 0 增至 67/160,却更容易漏掉四流跳表难例。结论不是“测试无用”,而是仅告诉 agent 技术名不足以传递真正的测试策略。

–

Benchmarking Qwen3.8 27B quantizations33quesma.com原文 ↗

quesma.com

Quesma 用 GPQA Diamond、IFBench 和 89 任务 Terminal-Bench 2.1 对比 Qwen3.8 27B 的多种量化。55GB BF16 压到 17GB 的 Q4_K_M,在这些测试上几乎不掉分,可在 24GB RTX 4090 留出约 64k 上下文;2-bit 开始退化,6.2GB 的 1-bit 接近随机且长思考更差。作者在 Modal 花约 3,000 美元,并提醒量化文件被替换会影响复现,这让“4-bit 足够好”必须绑定版本和任务条件。

–

Latest open artifacts #2434interconnects.ai原文 ↗

interconnects.ai

Nathan Lambert 汇总 Motif-3、GLM-5.3、Hy4-preview 等开放模型工件,同时检查权重、代码、数据和许可证是否真的开放。文章的技术判断不只看榜单分数,还看能否再分发、商用和重现实验;这种拆分避免把 open-weight 误读成完整的开源许可,适合做模型选型的第一轮筛查。

–

I've factored the RSA keys of a Certificate Authority from the 90s35mcpherrin.ca原文 ↗

mcpherrin.ca

作者记录从旧证书收集、识别弱随机性或重复因子,到用现代整数分解恢复私钥并验证签名的过程。案例说明历史上“够长”的 RSA 密钥会因尺寸、实现和备份暴露而失效,真正有价值的是完整取证证据链;它也提醒迁移遗留 PKI 时要检查已撤销证书之外的离线副本。

–

We have a year to fix security everywhere36jyn.dev原文 ↗

jyn.dev

文章警告开源权重、低成本强模型会把漏洞扫描和利用推向自动化,并引用 GLM 5.3 在 CyberGym 约 84.5%、ExploitBench 约 54.4% 的成绩。作者认为补洞速度可能快过补丁部署到电网、旧服务器等关键系统,因而把身份、权限、依赖和供应链治理列为短期工程任务;同时承认基准外推和“一年”判断带有不确定性。

–

There's a new “Google Jail” for independent wikis37weirdgloop.org原文 ↗

weirdgloop.org

Weird Gloop 观察到 2024 年 3 月后约 90% 新域名 wiki 只能让主页出现在 Google 结果中,而游戏 wiki 约 85% 流量来自 Google。已有域名的子域名却能立即收录,因此站点先把新 wiki 放到自己的子域名,计划约半年后用 301 迁回独立域名。这个案例把 SEO 变化转成迁移架构决策,也展示了需要公开数据来验证“Google Jail”是否真是算法机制。

–

The VMs Powering Mobile Agents38rohanadwankar.github.io原文 ↗

rohanadwankar.github.io

文章从 Instinct、Claude Code 等移动 agent 服务反推其 VM 平台:每次任务都需要隔离文件系统、网络、凭据和可回收计算,并通过快照、休眠与终端/浏览器通道维持交互。它把移动体验的稳定性归因于后端编排和安全边界,而非单纯模型能力;不同供应商规格未统一披露,重点应放在资源生命周期与权限设计。

–

I tested 10 model/harness combinations on the same Three.js task39alvins82.github.io原文 ↗

alvins82.github.io

作者固定一个 Three.js 任务,横向比较十种模型和 agent harness 的代码、视觉输出及迭代过程。控制任务变量后,模型本身与工具脚手架的影响可以分开观察;但单任务、主观视觉评分和有限样本意味着结果更适合作为工程案例,不能当作通用模型排名。

–

Creepy crawlies40simonwillison.net原文 ↗

simonwillison.net

Simon Willison 转述 git.kernel.org 维护者的测量:五个节点同时约有 14 个 CPU 核只在为抓取器渲染提交 HTML,成本超过其他合法访问(包括 git clone)。这把“恶意爬虫背景噪声”具体化为长期 CPU 账单,也说明 Datasette 等可爬取服务应把缓存、速率限制和机器人识别纳入容量设计。

–

Antiquated HTML Snippets and Artefacts41vale.rocks原文 ↗

vale.rocks

文章从历史网页中挑出过时标签、属性和兼容片段,解释它们与旧浏览器、低带宽和渐进增强之间的关系。把这些写法放回当时的约束后,所谓“丑陋 HTML”变成可理解的工程折中;材料适合做前端考古,不应被当成现代规范或兼容性建议。

–

How to bring up the Linux Kernel on a new platform42werwolv.net原文 ↗

werwolv.net

这篇实战按引导加载、设备树、串口、时钟、内存和外设驱动的顺序讲新平台 bring-up,强调用早期日志和二分配置把“内核没起来”拆成可定位问题。设备树描述与驱动联调是从能启动到能工作的主要工作量;方法对 SoC 移植有可复用性,但硬件细节仍决定具体命令和调试器选择。

–

Bitap: my favorite string matching algorithm43jo3-l.dev原文 ↗

jo3-l.dev

Bitap 用机器字位表示模式状态,每读一个字符就移位并与预计算掩码组合,精确匹配和允许错误的近似匹配都能在一次扫描中完成。位并行让短模式非常快,限制是模式长度受字宽约束,长模式需要分块或换算法;文章把状态位推导展开,适合重新理解字符串匹配而不只是调用库函数。

–

引用来源 · References

52 条 · 引用
  1. 1 C*: Unifying Programming and Verification in C. arXiv:2504.02246https://arxiv.org/abs/2504.02246 ↩ 回到正文 · back to text
  2. 2 deltafinhttps://github.com/argonautlabsai/deltafin ↩ 回到正文 · back to text
  3. 3 nvkvm-pvhttps://github.com/reindertpelsma/nvkvm-pv ↩ 回到正文 · back to text
  4. 4 vllm-project/agentic-apihttps://github.com/vllm-project/agentic-api ↩ 回到正文 · back to text
  5. 5 Archprinthttps://github.com/Tommkruix/archprint ↩ 回到正文 · back to text
  6. 6 LLM Attention Visualizationhttps://ishamf.dev/p/llm-attention-visualizer/ ↩ 回到正文 · back to text
  7. 7 I-have-ADHDhttps://github.com/ayghri/i-have-adhd ↩ 回到正文 · back to text
  8. 8 Copperheadhttps://copperhead.sh/ ↩ 回到正文 · back to text
  9. 9 Grithhttps://github.com/grith-ai/grith ↩ 回到正文 · back to text
  10. 10 Browser LLM Fithttps://news.ycombinator.com/item?id=49617427 ↩ 回到正文 · back to text
  11. 11 DeepMemhttps://github.com/deepmemteam/deepmem ↩ 回到正文 · back to text
  12. 12 ChronoVechttps://github.com/mchl-labs/chronovec ↩ 回到正文 · back to text
  13. 13 Blackholeshttps://blackholes.dev ↩ 回到正文 · back to text
  14. 14 Felanhttps://github.com/felan-ai/felan ↩ 回到正文 · back to text
  15. 15 Keyfencehttps://github.com/aminueza/Keyfence ↩ 回到正文 · back to text
  16. 16 Linihttps://lini.rs/ ↩ 回到正文 · back to text
  17. 17 TALA Is Open-Sourcehttps://d2lang.com/blog/tala-is-open-source/ ↩ 回到正文 · back to text
  18. 18 On the Navier - Stokes Millennium Prize Problemhttps://openai.com/index/navier-stokes-solution/ ↩ 回到正文 · back to text
  19. 19 AlphaGenome Atlashttps://deepmind.google/blog/alphagenome-atlas-a-predictive-map-of-every-possible-dna-letter-change-in-the-human-genome/ ↩ 回到正文 · back to text
  20. 20 ChatGPT Images 2.5https://openai.com/index/introducing-chatgpt-images-2-5/ ↩ 回到正文 · back to text
  21. 21 Musehttps://ai.meta.com/muse/ ↩ 回到正文 · back to text
  22. 22 Mercury 2.5https://www.inceptionlabs.ai/blog/introducing-mercury-2-5 ↩ 回到正文 · back to text
  23. 23 Mistral raises €3Bhttps://mistral.ai/news/mistral-makes-sovereign-open-weight-ai-to-frontier/ ↩ 回到正文 · back to text
  24. 24 LG TVs caught spying even when offline or on standbyhttps://www.theverge.com/tech/991190/lg-tv-spying-standby-recording-wi-fi-scanning-gamers-nexus ↩ 回到正文 · back to text
  25. 25 LibreOffice breaks download records after declaring it has no AI featureshttps://manualdousuario.net/en/libreoffice-download-record-no-ai/ ↩ 回到正文 · back to text
  26. 26 Leaving VMware just got harder after Broadcom pulled VDDK downloadshttps://www.virtualizationhowto.com/2026/09/leaving-vmware-just-got-harder-after-broadcom-pulled-vddk-downloads/ ↩ 回到正文 · back to text
  27. 27 DaVinci Resolve 21.1https://www.blackmagicdesign.com/media/release/20260908-03 ↩ 回到正文 · back to text
  28. 28 FreeBSD 14.5-Releasehttps://www.freebsd.org/releases/14.5R/announce/ ↩ 回到正文 · back to text
  29. 29 Jellyfin 12.0https://jellyfin.org/posts/jellyfin-release-12.0/ ↩ 回到正文 · back to text
  30. 30 How GPT-5.6 Sol helps run quantum computing experimentshttps://openai.com/index/codex-quantum-computing-experiments ↩ 回到正文 · back to text
  31. 31 Statement on finite-time blowup for forced 3D Euler, and OpenAI's conducthttps://cims.nyu.edu/~tristanb/statement.pdf ↩ 回到正文 · back to text
  32. 32 How well do agents use test/verification techniques?https://danluu.com/agentic-testing/ ↩ 回到正文 · back to text
  33. 33 Benchmarking Qwen3.8 27B quantizationshttps://quesma.com/blog/qwen38-27b-quantizations-benchmarked/ ↩ 回到正文 · back to text
  34. 34 Latest open artifacts #24https://www.interconnects.ai/p/latest-open-artifacts-24-motif-3 ↩ 回到正文 · back to text
  35. 35 I've factored the RSA keys of a Certificate Authority from the 90shttps://mcpherrin.ca/2026/09/07/rsa.html ↩ 回到正文 · back to text
  36. 36 We have a year to fix security everywherehttps://jyn.dev/a-year-to-fix-security/ ↩ 回到正文 · back to text
  37. 37 There's a new “Google Jail” for independent wikishttps://weirdgloop.org/blog/google-jail ↩ 回到正文 · back to text
  38. 38 The VMs Powering Mobile Agentshttps://rohanadwankar.github.io/posts/platforms.html ↩ 回到正文 · back to text
  39. 39 I tested 10 model/harness combinations on the same Three.js taskhttps://alvins82.github.io/hangar-harness-model-tests/ ↩ 回到正文 · back to text
  40. 40 Creepy crawlieshttps://simonwillison.net/2026/Sep/7/creepy-crawlies/ ↩ 回到正文 · back to text
  41. 41 Antiquated HTML Snippets and Artefactshttps://vale.rocks/posts/html-relics ↩ 回到正文 · back to text
  42. 42 How to bring up the Linux Kernel on a new platformhttps://werwolv.net/posts/linux_bringup/ ↩ 回到正文 · back to text
  43. 43 Bitap: my favorite string matching algorithmhttps://jo3-l.dev/posts/bitap/ ↩ 回到正文 · back to text
  44. 44 huggingface/funeshttps://github.com/huggingface/funes ↩ 回到正文 · back to text
  45. 45 remorses/gpuixhttps://github.com/remorses/gpuix ↩ 回到正文 · back to text
  46. 46 lightpanda-io/browserhttps://github.com/lightpanda-io/browser ↩ 回到正文 · back to text
  47. 47 mksglu/context-modehttps://github.com/mksglu/context-mode ↩ 回到正文 · back to text
  48. 48 advaitpaliwal/feynmanhttps://github.com/advaitpaliwal/feynman ↩ 回到正文 · back to text
  49. 49 NVIDIA/personaplexhttps://github.com/NVIDIA/personaplex ↩ 回到正文 · back to text
  50. 50 roboflow/rf-detrhttps://github.com/roboflow/rf-detr ↩ 回到正文 · back to text
  51. 51 getopenscreen/openscreenhttps://github.com/getopenscreen/openscreen ↩ 回到正文 · back to text
  52. 52 vrtmrz/obsidian-livesynchttps://github.com/vrtmrz/obsidian-livesync ↩ 回到正文 · back to text