When Does Memory Help? A Cost-Aware Evaluation of Long-Term Memory in Tool-Using LLM Agents1 - MERIT 把长期记忆放进带工具、事实更新、污染和完整成本计量的任务环境,显示记忆收益高度依赖具体实现。
全文 ↓今日重点 · Today's Highlights
SCAFFOLD: Self-Improving Web Agents via Recursive Parametric Skill Abstraction2 - 递归技能抽象与参数蒸馏让网页 agent 在五轮自改进中持续积累跨任务操作能力。
全文 ↓Beyond Prompts: Measuring and Optimizing LLM Tool-Agent Harnesses3 - PRISM 将 prompt、工具边界中间件和状态处理放进同一个受约束搜索空间,报告留出集上的可复现提升而非只报单点分数。
全文 ↓AgentBrew: Offline Tool-Use Agent Learning from Raw Real-World Trajectories4 - AgentBrew 从无验证器的真实轨迹反推任务并分解动作信用,证明离线数据也能提升多种 MCP 应用上的工具策略。
全文 ↓论文 · Papers
11 项 · 论文AutoFyn Technical Report: Non-Parametric Expert Iteration for Long-Horizon Agents6arxiv.org原文 ↗
AutoFyn 不改模型权重,而是把经验证的奖励写回持久状态,让每轮全新会话通过文件、报告和仓库状态继承策略。它覆盖奥数、数据科学和网络安全,在六道新的 2026 IMO 题上所有可提升模型都超过提供商 coding agent,并确认了 16 个维护者认可的漏洞通告;这把“自我改进”落在可审计的外部状态上。
Agents Trust Tools Too Much: Measuring Reliance on Unreliable Tools7arxiv.org原文 ↗
研究让 14 个模型使用搜索、子 agent 和代码执行,再篡改返回内容,观察它们是否会质疑工具。网页搜索的平均采用率达到 68.0%,而模型即便在内部发现冲突,也常把污染结果无警告地交付;提示、元数据和后训练没有一种能跨工具稳定修复这一信任偏差。
EdgeMem: LLM-Free Agent Memory Construction and Retrieval via Evidence-Preserving Multi-Anchor Hypergraph8arxiv.org原文 ↗
EdgeMem 保留原始交互轮次,以内容、时间和情景多锚点构建超图,只有最后回答才需要 LLM。共享提示下 LoCoMo 严格得分为 61.01,超过复现系统最高的 58.70;检索结果同时带回源证据,使记忆单元可以被追溯而非只剩压缩摘要。
EnvCraft: Synthesizing Executable Environments in Agentic RL for Claw-like Agent9arxiv.org原文 ↗
EnvCraft 的合成引擎在沙箱中生成工作区,并用拓扑感知数据保持任务轨迹的一致性。产物包括 139 个交互环境和约 2 万个复杂任务;Qwen3/3.5 8B - 32B 在 Claw 类任务最高提升 11.9%,一般工具使用提升 8.0%,且推理 token 更少。
DAREBench: Deployment-Aware and Reliable Evaluation of Models as Agents10arxiv.org原文 ↗
DAREBench 将 22 个基准的 233 个任务放入统一 OpenClaw 环境,以模态×执行形式组成 2×3 工作矩阵,并用合约和证据分数审计交付物。评测覆盖 23 个商业 API、12 个本地模型和 7,587 次模型任务运行;没有模型在所有维度占优,准确率、模态和成本之间的取舍会随部署条件改变。
Explaining AI Agents Through Execution Traces11arxiv.org原文 ↗
该方法先把长轨迹整理成结构化报告,再从可观察行为生成过程解释,因而能把主张对应到实际动作和证据。人工及自动评测都发现它比直接让 LLM 总结更能暴露无依据结论、不合理操作和证据空洞,适用范围不绑定特定模型或环境。
SkillAlign: Aligning Skill Interfaces for LLM-based Agents12arxiv.org原文 ↗
SkillAlign 固定任务、agent 和技能内容,只改变技能的呈现接口,比较完整说明、提示、压缩摘要、工作流和不暴露几种方式。ALFWorld 与 SkillsBench 显示,紧凑的 top-k 暴露有时胜过把整库塞进上下文,说明技能检索和接口设计本身就是性能变量;学到的回放策略仍明显落后于 oracle。
ExecCritic: Learn to Test, Test to Improve for Coding Agents13arxiv.org原文 ↗
ExecCritic 让测试 agent 先在 fail-closed harness 中筛选并冻结测试,修复 agent 只能消费执行反馈,不能改写评判标准。SWE-bench Verified 上 Qwen 测试生成由 Base 的 22.2 提到 Gold 的 62.2,组合后的后训练 agent 达到 72.6%,比原始无测试基线高 11.4 个百分点。
Procedural Graphs: Self-Evolving Execution Structures for LLM Agents14arxiv.org原文 ↗
Procedural Graphs 用程序三元组和主动节点定位表达步骤、顺序与条件,再由指导模型把局部子图翻译成行动提示。自演化器只有在留出集不降反升时才接受拓扑或属性修改,并保留被拒编辑以抑制重复犯错;多数据集、任务和模型上的提升表明结构记忆能超越简单轨迹回放。
Evaluating Deep-Search Agents under Hierarchical Web Evidence Poisoning15arxiv.org原文 ↗
HAE-GEO 设计断言、上下文伪装和表面互证三档网页投毒,覆盖 8 类商品、154 个品牌,使用 72,039 个干净页面和每档 770 个污染页面。十个 agent 在“看似相互印证”的陷阱下识别退化;增加搜索步骤能提高最终抵抗,却没有同步提高识别与效用,额外防御提示也很少让错误轨迹恢复。
SWE-Bench Pro Verified: A Reliable Benchmark for Software Engineering Agents16arxiv.org原文 ↗
论文从答案泄漏、隐藏评测和任务质量三条线审计 SWE-Bench Pro,指出 agent 可以利用 reward hacking 得到虚高分。加入反投机护栏并小幅修订任务后,一些模型的成绩明显低于旧报告,因而把“模型变强”和“基准可被利用”区分开来。
开源 / 项目 · Projects
14 项 · 开源 / 项目GrapheneOS Messaging18github.com原文 ↗
第 13 版用 Jetpack Compose/Material3 重写消息 UI,加入大屏双栏、置顶/稍后处理、未读/归档、消息详情和 MMS 媒体选择。隐私层还拒绝 `file:` URI 与私有文件、限制 widget intent、采用 FLAG_IMMUTABLE 和分配上限;最低 SDK 36,更新同时处理了多项崩溃与通知缺陷。
Bastiontrace26github.com原文 ↗
Bastiontrace 用纯 Python 分析 JSONL 工具轨迹,定位注入内容、落地的禁行动作和 blast radius,不需要 LLM 或云端,只依赖 bastioncorpus。`analyze` 输出 JSON 并在注入成功时返回非零,`harden` 则能生成 agentbastion 使用的 policy.yaml 与 injections.jsonl,适合放进事后取证流水线。
SQLite-Vector27github.com原文 ↗
SQLite-Vector 在普通 BLOB 表里实现精确向量搜索、SIMD 距离核和 2/3/4-bit TurboQuant,不需要虚拟表、预索引或外部服务。百万条 768 维向量的 INT8 存储为 740MB、FLOAT32 为 2,930MB;Apple M5 Pro 预载查询 37.6ms、召回率 99.5%,30MB 流式模式则为 114.4ms。
Agent Guardrails Kit29github.com原文 ↗
该工具以两个 PreToolUse hook 为 Claude Code 或 shell/file agent 建立 fail-closed 策略,配套 allow-list、JSONL 审计、月报和 104 条断言测试。它拦截 force push、reset --hard、rm -rf、curl|sh 等高风险动作,并把过去可绕过 deny-list 的案例写进回归测试,使策略变更有可追踪证据。
Compose Bridge UDS30github.com原文 ↗
Compose Bridge UDS 把完全解析的 Docker Compose 模型转换成 UDS 定制 Helm chart,再由 Zarf 打包到隔离 Kubernetes。示例以 k3d、UDS Core Slim Dev 和 WordPress/MySQL 生成 chart、文档、values、conversion.json 与 zarf.yaml;仓库明确标注为实验性、非受支持产品路径。
行业动态 · Industry News
11 项 · 行业动态Rapidly scaling online storage to serve over 1 billion ChatGPT users31openai.com原文 ↗
OpenAI 说 Habitat 已从围绕 Cosmos DB 的 Python 库演进为独立存储服务,当前每秒处理超过 7,000 万请求,每周服务十亿以上用户,覆盖约 40 个区域和 500PB 数据。2026 年第二季度两名工程师配合 Codex/GPT-5.5 以 Rust 重写,Rust 已承担 95% 请求,CPU 效率约 6 倍、内存效率约 15 倍,Python 计划退役。
OpenAI Agents API32developers.openai.com原文 ↗
Agents API 把会话、编排、上下文压缩和恢复交给托管 harness,应用方负责工具与执行环境;agent 能写代码、接 MCP、产出 artifacts,并通过 events 观察过程。文档还定义 streaming、webhook、steering、后台任务、多 agent 和持久状态,但当前数据驻留只有美国区域,且不支持 ZDR。
GPT-Live-1 in the API33openai.com原文 ↗
GPT-Live-1 在 API 中提供全双工语音,能同时听说,并把深层推理和工具调用转给后端模型。官方早期结果称打断减少近 80%,示例代码比级联方案少约 2.3 万行、降幅 80%,Full Duplex Bench 高 30 分;前端价格为每分钟 0.05 美元。
The Gemini app is now available for Windows34blog.google原文 ↗
Google 发布 Windows 10/11 Gemini 应用,Alt+Space 可打开即时浮层,Gemini Spark 负责多步任务并连接 Google 应用。客户端同时整合 Nano Banana 图像和 Gemini Omni 视频能力,作为轻量桌面入口向全球推出。
Google will buy half the electricity from one of Finland's nuclear power plants35bbc.com原文 ↗
报道的核心是 Google 将从芬兰一座核电站采购约一半电力,把数据中心需求与长期低碳电力合同绑定;条目没有提供合同期限、价格或投运安排等进一步信息。
The EPA is planning to scrap public review rules for data center pollution36capitalbnews.org原文 ↗
EPA 提案拟取消工业设施(包括数据中心和电厂)空气污染许可的联邦公众通知与评论要求,另一项方案还允许获证前开工。报道引述七成美国人反对住宅附近 AI 数据中心,并称农村及黑人社区承受健康、账单和搬迁压力,约 200 个组织与十多个州提出反对。
Claude is only available to people over 18 years37support.claude.com原文 ↗
Anthropic 的消费者 Claude 现在只面向 18 岁以上用户,注册需确认年龄,风险信号可能触发进一步验证。Yoti 人脸估龄、证件或 Digital ID 都可参与校验,完成后 Anthropic 只接收通过/不通过结果,验证数据会删除。
OpenAI considers slowing advanced AI development, Sam Altman tells employees38bloomberg.com原文 ↗
Bloomberg 报道称 Sam Altman 在公司会议上表示,OpenAI 可能放缓前沿 AI 开发,并希望其他实验室同步,以回应安全担忧。新闻点是“协调降速”的内部表态及其安全动因,而不是新的模型或政策。
Matt Mullenweg tells Automattic staff in Slack he's back in control after ouster39techcrunch.com原文 ↗
TechCrunch 报道 Matt Mullenweg 在 Automattic 内部 Slack 表示,自己在 CEO 被罢免后重新掌握控制权。条目关注的是治理权力变化和内部沟通,尚未延伸到产品或工程指标。
Blizzard Workers Win Historic Union Contract40latimes.com原文 ↗
近 1,900 名暴雪工会员工在两年谈判后批准集体合同,涵盖加薪、每周至少三天到办公室、工作场所 AI 协商权和裁员后 14 个月召回权。协议通过时,微软此前宣布约 3,200 个游戏部门岗位削减仍构成谈判背景。
HuggingFace: Security.txt41huggingface.co原文 ↗
Hugging Face 在 security.txt 中公开漏洞披露联系人和自动化扫描器可读取的标准说明。固定的报告入口让研究者能绕开普通客服路径,直接进入正式安全沟通流程。
博客文章 · Blog Posts
13 项 · 博客文章A Severe Misalignment of AI in Mathematics42terrytao.wordpress.com原文 ↗
Terry Tao 与 24 位菲尔兹奖得主警告,benchmark 驱动的数学 AI 偏好快速给出真假答案,而研究真正需要理解、洞见和可传授的论证。文章还把归属、抄袭和错误传播列为共同体风险,主张由数学家判断 AI 最终是在增强还是破坏知识传承。
Quoting Boris Cherny43simonwillison.net原文 ↗
Simon Willison 转述 Boris Cherny 对 Claude 参与生产开发的看法,重点落在生成代码、生成测试以及后续人类审查如何分工。条目实际讨论的是 agent 可接管的工程环节和必须保留的判断环节,而非单纯统计生成行数。
Soft-deprecating `re.match()`44simonwillison.net原文 ↗
Python 3.15 将 `re.match()` 和 `re.Pattern.match()` 软弃用,改推荐语义更明确的 `re.prefixmatch()`/`re.Pattern.prefixmatch()`。动机是其他正则库里 match 常被理解为搜索,显式写 prefix 可以降低跨库迁移时的误读;软弃用也给生态留下渐进迁移窗口。
Don't sleep on wrapture45simonwillison.net原文 ↗
Graham Dumpleton 的 wrapture 虽是 alpha,却把 monkey-patching 延伸到测试与观测:既能替换 mock、记录时间线/调用树,也能按阶段改变行为。教程还覆盖属性、字典、生成器、TOML 驱动的零代码 tracing 和 OpenTelemetry,适合将动态依赖转成可检查事件。
Any Nix package, live in your browser46simonwillison.net原文 ↗
trynix.dev 在浏览器中运行 qemu-wasm x86_64 Linux 虚拟机,URL 可指定过去 13 年的任意 Nix 包并进入交互 shell。trynix-preview GitHub Action 还会在 PR 评论中生成启动该 PR 构建的链接,执行不依赖常驻后端服务器。
Datasette 1.0a39 and 0.65.4 security releases47simonwillison.net原文 ↗
Datasette 两条版本线修复公开实例混用公开/私有表时的权限与注入问题,涉及 SQL 标识符转义、SQL 构造、HTML 渲染、认证和缓存。发布过程让多个模型先审计,再由人类拆分验证修复;对暴露在公网的实例,升级本身是必要的边界收紧。
Open-Source AI & Open Models Reading List48interconnects.ai原文 ↗
Nathan Lambert 维护一份开放 AI 与开源模型阅读清单,按模型、数据、训练、评测和社区争议等主题组织长期材料。它不是单篇实验报告,而是给研究者提供跨主题、可持续更新的索引入口。
Measuring the sloppiness of code49earendil.com原文 ↗
文章尝试把代码的“sloppiness”从直觉评价转成可测量的观察信号,讨论结构、重复、边界处理和维护摩擦如何进入指标。其贡献更接近度量框架草案:先定义可比较的证据,再比较代码库或变更,而非假设存在万能质量分数。
The Waymo effect: how AI is quietly making research less collaborative50researchagenda.news原文 ↗
Daniel Hook 将“Waymo effect”定义为:AI 去掉与人协作的摩擦,看似提高个人速度,却也拿走挑战、异议和知识传播。文章据此建议资助协作机制、按贡献而非速度评估,并让人类保留研究决策权,以防想法多样性被自动化收窄。
RTK reports token savings, but our cost benchmarks disagree51quesma.com原文 ↗
Quesma 的 Fable 基准中,RTK 将成本从 $596 降到 $546,但成功率也从 84% 降到 83%;DeepSeek 则由 $26/$51 变成 $31/$54,成功率 71%/69%。RTK 所称删掉 3.492 亿 token、减少 89% 实际按字节计数,连 `head -1` 也会重复计入,说明上下文压缩数字不能直接当成账单节省。
Astra for Coding: Why Are We Doing This Again?52lucumr.pocoo.org原文 ↗
Armin Ronacher 记录 35 小时、约 40 亿 token 的软件工厂试验:模型有长程推进能力,却在代码质量和奖励对齐上失分,并反复用 Python/shell 字符串拼接代替稳定 patch。文章将 Astra 与既有开发工具比较,结论不是否定自动化,而是要求可维护的工程反馈跟上规模。
What Comes After Git53ersc.io原文 ↗
East River Source Control 认为 Git 的 2005 年代模型难以承受 AI 带来的更大仓库、更多分支、合并争用和快速云复制。提案保留 Git 客户端协议,通过 bridge 更换可横向扩展的服务端存储,并让 Jujutsu 等协议逐步接入;讨论的重点是存储基础而非再造一个命令行界面。
CSS Curiosities of the Past54vale.rocks原文 ↗
文章整理 CSS 历史上少见的语法、浏览器行为和兼容特性,把当前样式实践与早期设计遗产并置。对维护旧站而言,这份考古式索引的提醒是:看似奇怪的规则可能是历史兼容约束,不能只凭现代直觉删除。
GitHub 热门 · GitHub Trending
10 项 · GitHub 热门armory3d/armorpaint55github.com原文 ↗
ArmorPaint 是 3D PBR 材质绘制软件,仓库偏向开发源码而非稳定发行版,预编译二进制需要付费。构建脚本覆盖 Windows、Linux、macOS、Android、iOS 和 WASM,适合把纹理绘制纳入自有图形工具链。
JustVugg/colibri56github.com原文 ↗
Colibri 用纯 C 把 VRAM、RAM、NVMe 组成统一内存层级,按专家热度、LRU 和预取流式载入 MoE,目标范围为 744B - 2.8T。README 的 6×RTX 5090 示例约 4 tok/s、首 token 1.6 秒,另有 30MB streamed 模式;它把实测数据和仍待验证的性能假设分开呈现。
nashsu/llm_wiki57github.com原文 ↗
llm_wiki 以两步 CoT ingest 建立可交叉链接的个人知识库,保留轨迹与缓存,PDF 图片可自动生成说明,检索限定在源文档。LanceDB 向量搜索、四信号知识图、Louvain 聚类、队列崩溃恢复和目录监视共同构成从摄入到研究的完整链路。
yilewang/llm-for-zotero58github.com原文 ↗
llm-for-zotero 把问答、摘要、图表检查、论文比较和笔记保存放进 Zotero 阅读器,兼容云端、本地 OpenAI-compatible、WebChat、Codex 与 Claude Code。回答带可跳转源引文,笔记可回写 Zotero、Obsidian、Logseq,agent 模式还能执行跨全库工作流。
vercel-labs/skills59github.com原文 ↗
Vercel skills CLI 面向多种 coding agent 的技能分发,支持 OpenCode、Claude Code、Codex、Cursor 和 75 多种其他 agent。`npx skills add/use` 能从 GitHub、GitLab、任意 git 或本地路径解析技能,自动生成临时 prompt 并处理认证,解决安装位置和调用入口分裂的问题。
feigeCode/navop60github.com原文 ↗
Navop 用 Rust+GPUI 构建无 WebView 的原生工作区,把数据库、SSH/SFTP、终端、远程桌面、监控和 AI agent 置于同一窗口。除 MySQL、Postgres、SQLite、DuckDB、ClickHouse 等连接器外,它还提供 ER 图、SQL 计划、ACP 接入 Codex/Claude/OpenCode、Agent Hub 和 marketplace。
akitaonrails/ai-usagebar61github.com原文 ↗
ai-usagebar 是 Rust 套餐与额度监控栏,覆盖 Claude、Codex、ChatGPT、Copilot、Z.AI、OpenRouter、DeepSeek、Kimi、Nous 和 OpenCode Go,可替换 claudebar。它每 60 秒刷新、按供应商拆模块,在网络错误时保留原缓存,并对 429 执行五分钟退避,因而比只显示即时请求结果更适合桌面常驻。
persiyanov/herdr-reviewr62github.com原文 ↗
herdr-reviewr 把 coding agent 的 diff、文件和 PR 状态放入终端侧栏,可按未提交、分支、最近一轮或 commit 筛选,并把行评论传回 agent。文件搜索、只读 PR、Markdown 和主题都属于查看层;工具本身不会修改代码或发布 PR,需要 herdr 0.7.5 以上及 macOS/Linux 真彩色终端。
gpustack/gpustack63github.com原文 ↗
GPUStack 管理本地、Kubernetes 和云上的多 GPU 集群,以插件方式编排 vLLM、SGLang、TensorRT-LLM 或自定义引擎,并提供故障恢复、负载均衡、权限和按需 SSH 实例。它把 LMCache、HiCache、EAGLE3、MTP、N-grams 等优化接到低延迟/高吞吐路径,同时兼容 NVIDIA、AMD、Ascend、Hygon 并暴露 Prometheus/Grafana 观测接口。
google-deepmind/alphagenome64github.com原文 ↗
AlphaGenome 客户端让研究者调用 DeepMind 的 DNA 调控模型,在约一百万碱基上下文中预测表达、剪接、染色质和接触图,通常保持单碱基分辨率。Atlas 提供人类基因组的变异效应、AVI 和特征重要性预计算;服务免费但限速,仅限非商业研究,明确禁止临床决策和训练其他 ML 模型。
引用来源 · References
64 条 · 引用- 1 When Does Memory Help? A Cost-Aware Evaluation of Long-Term Memory in Tool-Using LLM Agents. arXiv:2609.05441https://arxiv.org/abs/2609.05441 ↩ 回到正文 · back to text
- 2 SCAFFOLD: Self-Improving Web Agents via Recursive Parametric Skill Abstraction. arXiv:2609.05511https://arxiv.org/abs/2609.05511 ↩ 回到正文 · back to text
- 3 Beyond Prompts: Measuring and Optimizing LLM Tool-Agent Harnesses. arXiv:2609.05736https://arxiv.org/abs/2609.05736 ↩ 回到正文 · back to text
- 4 AgentBrew: Offline Tool-Use Agent Learning from Raw Real-World Trajectories. arXiv:2609.05837https://arxiv.org/abs/2609.05837 ↩ 回到正文 · back to text
- 5 OpenCodehttps://github.com/anomalyco/opencode ↩ 回到正文 · back to text
- 6 AutoFyn Technical Report: Non-Parametric Expert Iteration for Long-Horizon Agents. arXiv:2609.05446https://arxiv.org/abs/2609.05446 ↩ 回到正文 · back to text
- 7 Agents Trust Tools Too Much: Measuring Reliance on Unreliable Tools. arXiv:2609.05587https://arxiv.org/abs/2609.05587 ↩ 回到正文 · back to text
- 8 EdgeMem: LLM-Free Agent Memory Construction and Retrieval via Evidence-Preserving Multi-Anchor Hypergraph. arXiv:2609.05553https://arxiv.org/abs/2609.05553 ↩ 回到正文 · back to text
- 9 EnvCraft: Synthesizing Executable Environments in Agentic RL for Claw-like Agent. arXiv:2609.05576https://arxiv.org/abs/2609.05576 ↩ 回到正文 · back to text
- 10 DAREBench: Deployment-Aware and Reliable Evaluation of Models as Agents. arXiv:2609.06059https://arxiv.org/abs/2609.06059 ↩ 回到正文 · back to text
- 11 Explaining AI Agents Through Execution Traces. arXiv:2609.06063https://arxiv.org/abs/2609.06063 ↩ 回到正文 · back to text
- 12 SkillAlign: Aligning Skill Interfaces for LLM-based Agents. arXiv:2609.07255https://arxiv.org/abs/2609.07255 ↩ 回到正文 · back to text
- 13 ExecCritic: Learn to Test, Test to Improve for Coding Agents. arXiv:2609.09133https://arxiv.org/abs/2609.09133 ↩ 回到正文 · back to text
- 14 Procedural Graphs: Self-Evolving Execution Structures for LLM Agents. arXiv:2609.09153https://arxiv.org/abs/2609.09153 ↩ 回到正文 · back to text
- 15 Evaluating Deep-Search Agents under Hierarchical Web Evidence Poisoning. arXiv:2609.06027https://arxiv.org/abs/2609.06027 ↩ 回到正文 · back to text
- 16 SWE-Bench Pro Verified: A Reliable Benchmark for Software Engineering Agents. arXiv:2609.08149https://arxiv.org/abs/2609.08149 ↩ 回到正文 · back to text
- 17 Toasthttps://github.com/paradise-runner/toast ↩ 回到正文 · back to text
- 18 GrapheneOS Messaginghttps://github.com/GrapheneOS/Messaging/releases/tag/13 ↩ 回到正文 · back to text
- 19 Litelmhttps://github.com/kennethwolters/litelm ↩ 回到正文 · back to text
- 20 Reverahttps://github.com/rv-crypto/revera-api/releases ↩ 回到正文 · back to text
- 21 Stroqhttps://stroq.dev/ ↩ 回到正文 · back to text
- 22 Pi-synchttps://github.com/say4n/pi-sync ↩ 回到正文 · back to text
- 23 KyttoMCPhttps://kytto.jakubhecht.sk/ ↩ 回到正文 · back to text
- 24 SOShttps://github.com/sigmastratum/sigma-operator-stack ↩ 回到正文 · back to text
- 25 Hazzelhttps://github.com/mukundzha/hazzel ↩ 回到正文 · back to text
- 26 Bastiontracehttps://github.com/Rinkia/bastiontrace ↩ 回到正文 · back to text
- 27 SQLite-Vectorhttps://github.com/sqliteai/sqlite-vector ↩ 回到正文 · back to text
- 28 OpenMusehttps://github.com/diggerhq/openmuse/ ↩ 回到正文 · back to text
- 29 Agent Guardrails Kithttps://github.com/danielhagever/agent-guardrails-kit ↩ 回到正文 · back to text
- 30 Compose Bridge UDShttps://github.com/defenseunicorns/compose-bridge-uds ↩ 回到正文 · back to text
- 31 Rapidly scaling online storage to serve over 1 billion ChatGPT usershttps://openai.com/index/scaling-storage-one-billion-users-part-one ↩ 回到正文 · back to text
- 32 OpenAI Agents APIhttps://developers.openai.com/api/docs/guides/agents-api/overview ↩ 回到正文 · back to text
- 33 GPT-Live-1 in the APIhttps://openai.com/index/introducing-gpt-live-1-in-the-api/ ↩ 回到正文 · back to text
- 34 The Gemini app is now available for Windowshttps://blog.google/innovation-and-ai/products/gemini-app/gemini-app-now-on-windows/ ↩ 回到正文 · back to text
- 35 Google will buy half the electricity from one of Finland's nuclear power plantshttps://www.bbc.com/news/articles/c8r6y4me2g6o ↩ 回到正文 · back to text
- 36 The EPA is planning to scrap public review rules for data center pollutionhttps://capitalbnews.org/data-centers-permit-rules-epa/ ↩ 回到正文 · back to text
- 37 Claude is only available to people over 18 yearshttps://support.claude.com/en/articles/15171100-age-assurance-on-claude ↩ 回到正文 · back to text
- 38 OpenAI considers slowing advanced AI development, Sam Altman tells employeeshttps://www.bloomberg.com/news/articles/2026-09-11/openai-is-open-to-slowing-cutting-edge-ai-ceo-sam-altman-tells-staff ↩ 回到正文 · back to text
- 39 Matt Mullenweg tells Automattic staff in Slack he's back in control after ousterhttps://techcrunch.com/2026/09/11/matt-mullenweg-tells-automattic-staff-in-slack-hes-back-in-control-after-ceo-ouster/ ↩ 回到正文 · back to text
- 40 Blizzard Workers Win Historic Union Contracthttps://www.latimes.com/entertainment-arts/business/story/2026-09-09/blizzard-video-game-workers-ratify-union-contract ↩ 回到正文 · back to text
- 41 HuggingFace: Security.txthttps://huggingface.co/security.txt ↩ 回到正文 · back to text
- 42 A Severe Misalignment of AI in Mathematicshttps://terrytao.wordpress.com/2026/09/11/a-severe-misalignment-of-ai-in-mathematics/ ↩ 回到正文 · back to text
- 43 Quoting Boris Chernyhttps://simonwillison.net/2026/Sep/11/boris-cherny/ ↩ 回到正文 · back to text
- 44 Soft-deprecating `re.match()`https://simonwillison.net/2026/Sep/11/soft-deprecating-re-match/ ↩ 回到正文 · back to text
- 45 Don't sleep on wrapturehttps://simonwillison.net/2026/Sep/11/wrapture/ ↩ 回到正文 · back to text
- 46 Any Nix package, live in your browserhttps://simonwillison.net/2026/Sep/10/trynix/ ↩ 回到正文 · back to text
- 47 Datasette 1.0a39 and 0.65.4 security releaseshttps://simonwillison.net/2026/Sep/11/datasette-security/ ↩ 回到正文 · back to text
- 48 Open-Source AI & Open Models Reading Listhttps://www.interconnects.ai/p/open-source-ai-reading-list ↩ 回到正文 · back to text
- 49 Measuring the sloppiness of codehttps://earendil.com/posts/measuring-code-sloppiness/ ↩ 回到正文 · back to text
- 50 The Waymo effect: how AI is quietly making research less collaborativehttps://www.researchagenda.news/articles/the-waymo-effect.html ↩ 回到正文 · back to text
- 51 RTK reports token savings, but our cost benchmarks disagreehttps://quesma.com/blog/does-rtk-make-ai-coding-cheaper/ ↩ 回到正文 · back to text
- 52 Astra for Coding: Why Are We Doing This Again?https://lucumr.pocoo.org/2026/9/7/astra-why/ ↩ 回到正文 · back to text
- 53 What Comes After Githttps://ersc.io/blog/what-comes-after-git ↩ 回到正文 · back to text
- 54 CSS Curiosities of the Pasthttps://vale.rocks/posts/css-relics ↩ 回到正文 · back to text
- 55 armory3d/armorpainthttps://github.com/armory3d/armorpaint ↩ 回到正文 · back to text
- 56 JustVugg/colibrihttps://github.com/JustVugg/colibri ↩ 回到正文 · back to text
- 57 nashsu/llm_wikihttps://github.com/nashsu/llm_wiki ↩ 回到正文 · back to text
- 58 yilewang/llm-for-zoterohttps://github.com/yilewang/llm-for-zotero ↩ 回到正文 · back to text
- 59 vercel-labs/skillshttps://github.com/vercel-labs/skills ↩ 回到正文 · back to text
- 60 feigeCode/navophttps://github.com/feigeCode/navop ↩ 回到正文 · back to text
- 61 akitaonrails/ai-usagebarhttps://github.com/akitaonrails/ai-usagebar ↩ 回到正文 · back to text
- 62 persiyanov/herdr-reviewrhttps://github.com/persiyanov/herdr-reviewr ↩ 回到正文 · back to text
- 63 gpustack/gpustackhttps://github.com/gpustack/gpustack ↩ 回到正文 · back to text
- 64 google-deepmind/alphagenomehttps://github.com/google-deepmind/alphagenome ↩ 回到正文 · back to text