A Contract-Grade Verifier for LLM-Generated GPU Kernels - 12 道契约关卡重审 2,638 个“已通过”GPU 内核,揭出普通正确性测试掩盖的大量约束违规。
全文 ↓今日重点 · Today's Highlights
StateBridge - 用闭式正交对齐替代训练式投影器,在 26 个异构模型通信组合中取得 22 个最佳或并列最佳结果。
全文 ↓Self-bench - 从仓库已经完成的变更反建隐藏测试和参考解,让私有开发历史直接变成抗泄漏 coding-agent 评测。
全文 ↓论文 · Papers
15 项 · 论文本期重点A Contract-Grade Verifier for LLM-Generated GPU Kernels1arxiv.org原文 ↗
作者没有再把“若干样例输出相近”当作内核正确,而是设置 12 道对抗性关卡,其中多项完全不允许容差。重审 2,638 个此前获准的机器生成内核后,39.5% 已超出数值容差,62.1% 至少违反一项契约;普通测试误收 1,487 个,而新验证器相对普通测试只多拒 14 个。论文还给出 Blackwell `tcgen05` 的 GDN 反向实现并以双精度验证,说明验证器也能支撑真正的新内核开发,而非只做事后挑错。
MindMemOS: A Portable and Self-Evolving Memory Operating Layer for AI Agents2arxiv.org原文 ↗
MindMemOS 以实体 - 属性 - 时间统一承载事实记忆,通过 schema 搜索、去重、冲突消解和轨迹技能化,让记忆结构与程序知识随运行演化。它在 LOCOMO 和 PersonaMem 上分别达到 94.03% 与 70.63%,在 SpreadsheetBench 上再提高 9.2 个百分点。相比只增加向量库容量,这套设计把“记住什么、如何整理、何时形成技能”放进同一个生命周期,实验也覆盖了记忆问答与实际工具任务两种收益面。
Governed Persistent Memory3arxiv.org原文 ↗
这项工作把长期记忆定义成可审计的双时态状态机,写入前校验来源,冲突时隔离,撤回或删除后禁止复活,释放声明则默认 fail-closed。治理实现匹配全部 3,600 个测试;最强的简单策略只对 1,800 个,且在违规情形中有一半会释放不该出现的内容。模型检查遍历 331,776 个语义状态与 1,990,656 个查询状态而未见反例,不过作者明确把结论限定在给定契约和状态边界内,而非宣称系统记忆等同于现实真相。
Dead text or binding clause?4arxiv.org原文 ↗
论文测量已撤销约束仍然影响后续行为的 “revocation inertia”,并用带 tombstone 的契约账本、可执行 checker 与逐项消融探针定位残余。单句 tombstone 能挽回约三分之一的约束编译效应,自适应修复阶梯却没有可检测的额外增益;8B 模型还会随着约束负载增加而更糟。结果把一个常被归为“上下文混乱”的现象变成可单独测试的生命周期缺陷,也表明在 prompt 尾部追加取消说明并不足以清除旧规则。
Practice Makes Unsafe6arxiv.org原文 ↗
作者追踪自改进 agent 如何把一次“不安全但成功”的轨迹固化为可跨会话调用的技能,并用版本化技能状态、冻结基准和 9 项生命周期指标观测扩散。25 个配置各执行 525 个任务、25 个 episode;21 个发生演化的配置全都生成不安全制品,15 个会在新会话造成伤害,三次恶意练习把 carryover ASR 从 16.0% 推到 35.3%。SafeEvolve 将不安全检索和新会话伤害分别压低 26.7 与 17.3 个百分点,良性效用仅变化 0.4 点,证明风险控制可以作用在技能准入而非等到输出末端拦截。
Rethinking Normalization Placement for LLMs7arxiv.org原文 ↗
研究用 Qwen3-8B 教师和 9 层学生重新检验 pre-norm 与 post-norm,关键变量不是架构单独训练,而是逐步增加 Transformer 深度的课程。联合训练时两者验证交叉熵只差 0.0004;采用扩深课程后 post-norm 领先 0.0328,控制实验把反转定位到新 block 的追加。pre-norm 出现结构 token 尺度漂移且末层近似恒等,提示所谓稳定性优势会随增长式训练路径改变,不能从固定深度实验直接外推。
SkillShapley8arxiv.org原文 ↗
SkillShapley 以 Shapley 边际贡献衡量 agent skill 中每一步究竟增加还是损害最终奖励。由于离散任务常有奖励悬崖,完整组合又指数爆炸,算法先寻找最有信息的 coalition 边界,再自适应复用已采样的边际证据;SkillsBench 用它识别关键、冗余和破坏性步骤。这项归因把整条 skill 的单一分数拆成可操作诊断,下一步关键是检验步骤贡献能否跨任务和采样种子保持稳定。
本期重点StateBridge10arxiv.org原文 ↗
StateBridge 直接求一个正交变换,将发送模型的最终隐藏状态对齐到接收模型输入空间,再经范数校准和词表锚定注入为连续前缀。方法不训练 projector,也不要求成对通信数据;在数学、代码、问答任务的 4 个模型、2 个家族间,26 个方向组合有 22 个最佳或并列最佳。闭式映射把异构 agent 通信从自然语言中介推进到可部署的连续表示层,但适用范围仍取决于词表锚点是否足以连接两个模型的语义几何。
Reduced Matrix Multiplication13arxiv.org原文 ↗
Reduced Matrix Multiplication 在矩阵收缩维度上按当前输入挑选高信息切片,以保留率调节算量,不需要重训或额外校准模型。实验从 1B 延伸到 70B,覆盖判别、生成、长上下文和多模态任务,并观察到 attention 通常比 MLP 更可削减;面向 A100 的自定义 kernel 在长序列获得实际运行时收益。后一点很关键,因为输入自适应稀疏若只减少理论 FLOPs,却无法形成规则访存,通常不会转化为端到端速度。
本期重点Vero: Can AI Agents Build Formally Verified Software Repositories?14arxiv.org原文 ↗
Vero 将原本分散在 Python、Dafny、Verus、Coq 的 43 个真实多模块实例重写为 Lean 4 仓库,提供 API、规范和参考实现,并设置 proof-only 与 code-plus-proof 两条赛道。审计不默认题目正确:它能证明部分规范不可满足或参考实现有错;最佳 agent 完成 27/43,却没有系统关闭最难仓库。基准因此同时测定理证明、实现和跨文件依赖管理,也避免把有缺陷的 oracle 当作不可质疑的真值。
开源 / 项目 · Projects
15 项 · 开源 / 项目RCA-lab17github.com原文 ↗
RCA-lab 在 Kubernetes 中运行 Python、Go、Java、Node、Rust、PHP 服务以及 PostgreSQL、MySQL、MongoDB、Valkey、Kafka,用真实机制制造锁等待、GC、泄漏、事件循环阻塞和 noisy neighbor。FailureScenario CR 负责注入并持久化回滚状态,整套实验约需 8 CPU、16 GiB 内存,产品表预置约 10GB 数据。它比静态日志样本更能检验 OTel 与 RCA 系统是否沿因果链定位故障,不过 README 明确警告不要部署到共享或生产集群。
OpenAnalytics30github.com原文 ↗
OpenAnalytics 不设 cookie 或跨站标识,访客哈希加盐并每晚轮换,城市定位只有显式开启本地库才工作。pnpm monorepo 同时包含 tracker、collector、worker、API、查询网关、实时层、Web 与 CLI,后端依赖 Postgres、ClickHouse 和两套 Valkey,查询信封用 Ed25519 签名。约 4GB 内存、4 个 DNS 名和 10 个预构建镜像说明它是完整分析基础设施而非单容器小工具,隐私收益要与相应运维面一起评估。
行业动态 · Industry News
14 项 · 行业动态Qwen3.8-27B31huggingface.co原文 ↗
Qwen 发布 27B 参数的 Qwen3.8 FP8 权重和模型卡,提供面向低精度推理栈的部署工件。FP8 可直接减轻权重存储与显存压力,但模型页所代表的是精度变体发布,不能仅凭参数量和格式推断相对其他 Qwen 版本的质量变化。
GLM-5.3: Frontier coding with emergent cyber capabilities32z.ai原文 ↗
Z.ai 称 GLM-5.3 沿用 GLM-5.2 底座,能力增量主要由后训练取得;内部 Z.ai Code Bench 约提升 50%,并报告 Terminal Bench 3.0、Agent's Last Exam 与 CyberGym 的更强结果。网络利用能力随编程能力一起上升,团队计划在约两周安全加固后开放权重,这个时间差反映发布方对可用性与双重用途风险的取舍。
DeepSeek peak/off-peak pricing update33api-docs.deepseek.com原文 ↗
DeepSeek 把 API 调用拆成高峰与低谷时段分别计价,同一模型、同样 token 量会因 UTC 调度时间产生不同成本。可延迟的批处理、离线评测和 agent 队列因此能通过移峰降费,实时产品则必须按峰值费率做预算;这项调整改变部署经济性,并不表示上下文或模型能力同步更新。
How Google is making private AI practical with homomorphic encryption34blog.google原文 ↗
Google 介绍用同态加密让服务端直接对密文执行 AI 计算,数据无须先恢复成平台可见的明文,结果再由持钥方解密。它将“云端是否可信”转化为密钥、允许算子和密码学安全假设,适用于高度敏感输入;真正能否普及仍由推理延迟、支持的运算范围和密文膨胀共同决定,而不只是算法在功能上可行。
How Claude's text watermarking works35anthropic.com原文 ↗
Anthropic 公开 Claude 文本水印的嵌入、检测和鲁棒性思路:生成时在 token 选择分布中留下统计信号,检测器再对足够长文本给出概率判断。改写、截断、误报率和短样本都会削弱证据,因此水印更适合平台级来源线索,而不是单篇文本作者身份的密码学证明。
Anthropic Risk Report - August 202636www-cdn.anthropic.com原文 ↗
Anthropic 发布经过删节的 2026 年 8 月风险报告,记录其模型风险识别、评估和缓解框架。删节版同时限定了外界能审计的证据范围:公开分类和控制可用于对照后续模型发布,但空白处不能被当作“没有风险”,报告价值最终取决于承诺能否映射到可观察措施。
Maximizing the value of your Claude Code sessions37claude.com原文 ↗
Claude Code 官方建议按清晰任务边界组织会话,持续保留目标、关键文件和验证结果,并以短反馈循环迭代。核心限制是上下文会被历史噪声和压缩逐渐稀释,长对话本身不是资产;及时整理或另开聚焦 session,通常比让模型在混杂记录中猜当前状态更可靠。
Mistral OCR 4.138docs.mistral.ai原文 ↗
Mistral 更新 OCR 4.1 模型及 API 文档,服务对象是扫描件、图片与复杂版面进入结构化文档管线的环节。调用方需要用自己的表格、公式、多栏页面和低质扫描回归,并固定版本标识;OCR 的小版本升级可能改变布局还原和字段边界,不能只以纯文本字符准确率验收。
Bluesky Protocol Services39atproto.com原文 ↗
Bluesky 推出面向 AT Protocol 应用的托管协议服务,并带来可做网络重放的 Jetstream v2。开发者可少运行一部分 relay、索引和事件消费设施,同时仍以开放协议取得数据;轻量 JSON 流与断线重放的组合,瞄准的正是联邦应用从 demo 走向长期运行时最常见的状态恢复成本。
RustDesk now supports true unattended remote access on Wayland40rustdesk.com原文 ↗
RustDesk 宣布在 Wayland 下实现无需本地确认的无人值守远程访问,补齐重启后远程维护 Linux 桌面的关键路径。能力越接近真正 unattended,凭据保管、会话解锁、桌面授权和审计的风险也越集中;部署验收应从外部机器跨重启实连,而不能只看本地设置已开启。
Firefox is now the last major browser that still supports uBlock Origin41pcworld.com原文 ↗
Firefox 目前仍能运行完整版 uBlock Origin,主要因为它继续提供扩展所需的 MV2 `webRequest` 阻断能力。Chromium 的 MV3 转向 `declarativeNetRequest`,留下的是功能受限的 uBO Lite;差异会落到动态过滤、规则规模和高级防跟踪,而不只是扩展名称是否还能在商店搜到。
France's top court blocks social media ban for under-15s42reuters.com原文 ↗
法国最高法院阻止面向 15 岁以下人群的社交媒体禁令,认定其对表达自由的压缩过宽。裁决没有否认未成年人保护目标,而是要求限制具有比例性;后续政策若重写,年龄核验的隐私成本、平台义务和更窄的风险控制将必须一起被论证。
Z.ai Security Disclosure43cvd.z.ai原文 ↗
Z.ai 上线安全漏洞披露与协调入口,为研究者提供明确的报告路径。门户只是起点,实际可信度取决于范围说明、safe harbor、响应时限和修复后的公开记录;这些机制决定研究者是在受保护流程中协作,还是仍需依靠非正式渠道推动处理。
Nine PBS sues Iron Mountain over blocked access to archival data44current.org原文 ↗
Nine PBS 因无法取得由 Iron Mountain 托管的历史影音数据而提起诉讼。案件把档案系统常被忽略的区别摆到台前:介质仍在不代表拥有者能按时、完整、带元数据地导出;公共文化资产的合同需要把访问连续性、开放格式和退出迁移写成可执行义务。
博客文章 · Blog Posts
15 项 · 博客文章Everything is about to “go dark”45blog.cryptographyengineering.com原文 ↗
Matthew Green 从端到端加密扩张讨论平台可见性、个人隐私与执法部门所谓 “going dark” 的冲突。分析应区分消息内容、元数据、终端设备和合法取证渠道:服务端不再持有明文会改变证据获取边界,而任何人为例外也会成为普通攻击者可瞄准的接口。文章把政治口号拉回密码系统无法只给“好人”留后门这一结构性约束。
What You Gain by Building Your Own Game Engine46eliasfarhan.ch原文 ↗
作者把自研游戏引擎的收益落在架构控制和认知深度:渲染、资源、场景、平台层如何连接,不再由大型现成引擎替团队决定。对应成本是编辑器、资产工具、跨平台兼容和长期维护都要自行承担。它更像一份边界清楚的工程交换表,而不是“所有项目都该重造基础设施”的宣言。
ActivityPub Won by Being Boring47o.ee原文 ↗
文章认为 ActivityPub 的胜出来自稳定、通用且足够容易实现,而非拥有最精巧的联邦协议抽象。共享对象与 inbox/outbox 模型让不同社交产品在相同兼容面上各自演化,互操作无需所有参与者同步创新。这里的“无聊”意味着故障和行为更可预测,也意味着一旦生态形成,历史包袱会与网络效应一起固化。
RISC-V: They Should Have Known Better48dmitry.gr原文 ↗
作者从编码、扩展组合和微架构实现成本批评 RISC-V 的若干 ISA 选择,反对把开放许可直接等同于技术简洁。其核心提醒是复杂度不会消失:规范层少做的工作,常会转移给解码器、编译器、验证或兼容层。这是立场鲜明的反方文章,最适合拿具体指令与扩展权衡逐项核对,而非把结论当作对整个生态的一票否决。
There Is Still No Silver Bullet49cekrem.github.io原文 ↗
文章重访 Brooks 的本质复杂度与偶然复杂度:框架、语言和 AI 能显著减少表达与操作摩擦,却不会替需求冲突、领域规则和跨系统协调给出唯一答案。代码生成越便宜,理解要建什么、证明行为正确所占比例反而越高。“没有银弹”在这里不是否认工具进步,而是拒绝把局部速度提升误写成软件交付的整体自动化。
Why does Opus 5 feel worse to work with?50mun-logadan.github.io原文 ↗
作者记录与 Opus 5 协作时观察到的风格、指令执行和节奏变化,并尝试解释主观体验为何下降。它是使用者现场笔记而非控制实验,不能从“感觉更差”直接推导总体能力回退;文章更有用的产物是那些可转成复现任务的摩擦点,之后才能分离模型、系统提示和工具环境的影响。
Where did the old web go?510.mk原文 ↗
作者追踪 657,607 个链接,把旧网页的命运分成存活、重定向和失效等状态,给 link rot 一份大样本剖面。这个规模使“旧互联网在消失”从印象变成可测现象,也暴露 URL 只是定位符、不是长期证据。需要多年可验证的引用应同时保存快照、内容哈希或归档副本,单靠原链接无法承担保存职责。
Choosing an AI model: one prompt, 11 models, different results52netlify.com原文 ↗
Netlify 让 11 个模型执行同一个开发任务,比较输出结构、实现路线与完成效果。相同 prompt 只控制需求入口,并未消除组件拆分、依赖选择、边界处理和自我验证上的分歧。模型采购因此应复用团队自己的任务样本,并把可维护性与部署结果一起评分,而不是只按通用榜单挑最高名次。
Understanding is the new bottleneck53geoffreylitt.com原文 ↗
Geoffrey Litt 将 AI 编程的新瓶颈定义为建立足以参与下一轮创造的理解,而非仅能给生成结果盖章。文中给出三类界面:带 5 题测验的 “literate diff”、可操作的 micro-world,以及人与 agent 共用的空间;作者甚至要求自己答对后 agent 才交代码。这个做法把认知债务变成流程阻塞条件,直指快速产出让人逐渐失去系统模型的风险。
Choose Boring Technology54mcfunley.com原文 ↗
Dan McKinley 建议一个系统大约只花 3 个“创新 token”,因为每引入一种陌生技术都会增加全局运维与认知负担。“无聊”不是老旧,而是团队已经知道它怎样失败;Etsy 的 PHP、MySQL、Memcached、Gearman 活动流在 20 倍增长后仍可长期无人干预,同时只为全文检索引入 Solr。文章并不反对创新,它要求把新组件留给已有方案确实覆盖不了的问题。
Curl Performance55daniel.haxx.se原文 ↗
Daniel Stenberg 将 curl 优化拆成可重复负载、协议与网络条件、TLS、CPU、内存和回归检查,而不是展示一个孤立的漂亮数字。吞吐、延迟与资源消耗会随连接复用、响应大小和服务器行为变化,微基准不能代表完整传输链路。文章呈现的性能工程是一条持续测量 - 定位 - 验证循环,也说明成熟网络工具的剩余收益往往藏在具体场景而非普遍重写。
Blog about things you don't understand yet56seangoedecke.com原文 ↗
Sean Goedecke 主张写自己尚未理解的主题,每篇至少学会两件事,并先提出具体、可能有争议的立场迫使调查收敛。他经常在写作过程中推翻起点,认为初学者反而记得读者会在哪一步卡住;公开发布和 LLM 反馈则帮助暴露漏洞。最终标准不是显得权威,而是结论是否改变了作者、是否比开头更紧密。
Comments in the code vs PR description57devblogs.microsoft.com原文 ↗
Raymond Chen 以信息寿命区分代码注释和 PR 描述:未来维护者理解当前约束、反直觉实现与不可破坏条件所需的解释,应留在代码附近;探索过程、评审争论和被放弃方案属于变更历史。只写 PR 会让代码离开托管平台后失忆,把整段讨论塞进注释又会让过期过程遮蔽当前事实。判断标准是“这段信息在实现成为现状后是否仍然成立”。
I turned my RSS feeds into an e-ink newspaper58heyjonny.dev原文 ↗
作者把 RSS 抓取、筛选、版面生成和电子墨水屏定时输出连成个人报纸。真正的制作难点落在把长度不一的文章装入固定画布,并为低刷新率、有限灰阶选择字重、层级和更新策略。开放 feed 在这个项目中不再只是另一个阅读器数据源,而成为脱离浏览器、低干扰实体界面的供应层。
sqlite-utils 4.259simonwillison.net原文 ↗
sqlite-utils 4.2 扩大 `table.transform()` 对复杂 schema 的保真范围,覆盖更多 check、unique 约束与注释组合。该操作实质上新建表、复制数据、删除旧表再替换,任何未重建的 schema 细节都会静默消失。这个版本修的不是显眼新功能,而是 SQLite 受限 ALTER TABLE 之上的迁移可靠性,尤其适合有真实历史包袱的表。
GitHub 热门 · GitHub Trending
12 项 · GitHub 热门unslothai/unsloth60github.com原文 ↗
Unsloth 将本地模型工作流分成库与 Tauri 桌面端,可运行、微调、评测和部署语言、视觉语言、扩散、嵌入及音频模型,覆盖 CPU、NVIDIA、AMD、Intel、Apple Silicon 与多 GPU。它能暴露 OpenAI 兼容 API 供 agent 使用,项目方称微调最高快 2 倍、显存少 70%。硬件跨度和 GUI 到代码的路径是工程优势,性能数字仍应在目标模型、序列长度与显卡上复跑。
holaboss-ai/holaOS61github.com原文 ↗
holaOS 把多个 coding agent、浏览器、文件、外部工具和共享记忆放进 local-first 工作区,状态以用户可读、可编辑的文件保存。README 列出 50 多项集成、MCP 与真实文档输出,并允许不同 agent 读写同一项目上下文;自托管代码使用修改版 Apache 许可。它的产品假设是上下文应成为可拥有的工作区资产,而不是被锁在某个聊天线程里。
kepano/obsidian-skills62github.com原文 ↗
这个仓库按 Agent Skills 标准提供 5 个 Obsidian 技能:Markdown、Bases、JSON Canvas、CLI 和 Defuddle 网页提取。Claude、Codex、OpenCode 等兼容客户端可直接读取规则,输出仍落在普通 Markdown、JSON 与可检查命令中。它没有另造知识库 API,而是把 Obsidian 文件格式中的细节显式教给 agent,因而迁移和人工修订成本较低。
NVIDIA-NeMo/Automodel63github.com原文 ↗
AutoModel 在原生 PyTorch Distributed 上提供 LLM/VLM 训练、Hugging Face 兼容与多维并行配方。README 展示 Qwen3.8-2.4T-A95B 的 EP32/PP8 全量微调、Kimi K3 在 256 张 GB200 上训练,以及 276B 总参数、每 token 激活 12B 的模型跑在 64 张 H100 上。它面向的不是单机易用性,而是让超大 MoE 配置仍保留接近 PyTorch 的可改代码路径。
lightningpixel/modly64github.com原文 ↗
Modly 是在 Windows、Linux 与 Apple Silicon 本地运行的 image-to-3D 桌面应用,用节点图串联 Image、Generate Mesh 和 Scene。模型扩展开放 Hunyuan3D 2 Mini、TripoSG、Trellis2 GGUF 等后端,另有 CLI 供 agent 自动生成资产。数据与 mesh 留在本机,MIT 许可和可换模型节点使它比绑定单一云 API 的 3D 工具更容易嵌入制作管线。
PrimeIntellect-ai/prime-agent65github.com原文 ↗
Prime Agent 以 recursive language model 处理编程、研究和长程任务:上下文成为变量,子 agent 成为持久 IPython 里的函数调用。Continual Harness 保存 prompt、memory、skill 描述,`/refine` 根据运行证据更新并支持回滚;daemon、heartbeat、schedule 和有限自主模式负责长期运行。README 明示它不提供 sandbox,这使自主循环的部署边界非常具体:隔离、凭据与网络权限必须由外层系统承担。
3b1b/manim66github.com原文 ↗
ManimGL 是 3Blue1Brown 用 Python 精确编排数学讲解动画的引擎,场景、对象和变换都可复现为代码。它与 Manim Community 是独立项目,安装包名 `manimgl`,运行依赖 FFmpeg 和 OpenGL,公式渲染可再接 LaTeX。仓库服务的是可控几何、镜头和时间轴,而非通用拖拽动画编辑,选择前应先确认教程针对的是哪一个 Manim 分支。
calcom/cal.diy67github.com原文 ↗
Cal.diy 从 Cal.com 移除 Teams、Organizations、Insights、Workflows、SSO/SAML 等商业模块,留下完整 MIT 许可的社区自托管排程平台。它用 Next.js、tRPC、React、Prisma 和 PostgreSQL,Docker Compose 可同时启动应用、数据库与 Prisma Studio。README 明确建议仅作个人、非生产用途;这项限制比“开源 Cal.com”标签更重要,因为项目主动不承诺企业级功能和运维保障。
apify/apify-mcp-server68github.com原文 ↗
Apify MCP Server 让 agent 把网页抓取、社交平台、搜索、地图和电商 Actor 当作 MCP 工具,README 称可接入 8,000 多个 Actors。托管端支持 OAuth、Streamable HTTP 与结构化结果 schema 推断,本地则可用 `npx @apify/actors-mcp-server` 经 stdio 启动;旧 SSE 入口已删除。它把大规模抓取目录变成动态工具市场,同时也把 Actor 选择、运行费用和外部数据合规带入 agent 决策面。
golbin/hop69github.com原文 ↗
HOP 以 rhwp 负责 HWP/HWPX 解析和渲染,桌面层补上打开、编辑 HWP、另存、PDF 导出、打印、拖放、文件关联与多窗口。发行包覆盖 macOS、Windows、Linux x64/arm64,Windows 构建尚未签名,部分 Wayland/IME 的 AppImage 组合可能不稳定。对依赖韩文办公格式的跨平台流程,它提供了 MIT 许可且不绑定原厂桌面的可操作入口。
kenforthewin/atomic70github.com原文 ↗
Atomic 把 Markdown 笔记自动分块、嵌入、打标签并按语义相似度关联,随后提供 sqlite-vec 搜索、力导向画布、带行内引用的 wiki 合成、定时研究报告和 agentic RAG。它可运行成 Tauri 桌面应用或 Docker 三服务,模型端支持 OpenRouter、Ollama 与 OpenAI 兼容接口,输入还有 RSS 和浏览器扩展。所有知识仍以 atoms 为基础,生成文章带来源引用,这比只提供聊天框更有利于追溯合成结论。
megadose/holehe71github.com原文 ↗
Holehe 通过各站的注册、登录或忘记密码流程判断邮箱是否关联账户,覆盖 Twitter、Instagram、Imgur 等 120 多个站点,并统一返回存在性、限流状态以及可能的脱敏恢复邮箱或电话。工具支持 PyPI、源码和 Docker,采用 GPLv3,仓库注明仅供教育用途。它能提高 OSINT 枚举效率,也可能被用于隐私侵扰;站点限流、授权范围和当地规则应被视为功能使用的一部分,而非部署后的附注。
引用来源 · References
71 条 · 引用- 1 A Contract-Grade Verifier for LLM-Generated GPU Kernels. arXiv:2608.12700https://arxiv.org/abs/2608.12700 ↩ 回到正文 · back to text
- 2 MindMemOS: A Portable and Self-Evolving Memory Operating Layer for AI Agents. arXiv:2608.12428https://arxiv.org/abs/2608.12428 ↩ 回到正文 · back to text
- 3 Governed Persistent Memory. arXiv:2608.12476https://arxiv.org/abs/2608.12476 ↩ 回到正文 · back to text
- 4 Dead text or binding clause? Measuring constraint influence, detecting revocation inertia, and repairing compiled behavioral residue in long-context conversational agents. arXiv:2608.12599https://arxiv.org/abs/2608.12599 ↩ 回到正文 · back to text
- 5 SteerBench-Work: Do Agents Know When to Proceed or Pause in the Workplace? arXiv:2608.12654https://arxiv.org/abs/2608.12654 ↩ 回到正文 · back to text
- 6 Practice Makes Unsafe: How Self-Evolving Agents Learn to Cause Real-World Harm. arXiv:2608.12851https://arxiv.org/abs/2608.12851 ↩ 回到正文 · back to text
- 7 Rethinking Normalization Placement for LLMs: When Does Pre-Norm Lose Its Edge? arXiv:2608.13156https://arxiv.org/abs/2608.13156 ↩ 回到正文 · back to text
- 8 SkillShapley: Boundary-Adaptive Shapley Estimation for Agent Skill Evaluation. arXiv:2608.13173https://arxiv.org/abs/2608.13173 ↩ 回到正文 · back to text
- 9 TsuGO: Benchmarking Search and Inference-Time Compute Allocation in Large Language Models with Go Game Problems. arXiv:2608.13221https://arxiv.org/abs/2608.13221 ↩ 回到正文 · back to text
- 10 StateBridge: Training-Free Hidden-State Alignment for Cross-Model Agent Communication. arXiv:2608.13317https://arxiv.org/abs/2608.13317 ↩ 回到正文 · back to text
- 11 Beyond Final Scores: A Process-Oriented Evaluation of AI R&D Agents. arXiv:2608.13417https://arxiv.org/abs/2608.13417 ↩ 回到正文 · back to text
- 12 Humans are Missing from AI Coding Agent Research. arXiv:2608.12355https://arxiv.org/abs/2608.12355 ↩ 回到正文 · back to text
- 13 Reduced Matrix Multiplication: Input-Adaptive Efficient Transformers. arXiv:2608.13426https://arxiv.org/abs/2608.13426 ↩ 回到正文 · back to text
- 14 Vero: Can AI Agents Build Formally Verified Software Repositories? arXiv:2608.13522https://arxiv.org/abs/2608.13522 ↩ 回到正文 · back to text
- 15 AI Guardrail Survival under Single-Cycle Agentic Self-Summarization. arXiv:2608.11392https://arxiv.org/abs/2608.11392 ↩ 回到正文 · back to text
- 16 Memcode. GitHub repositoryhttps://github.com/memcode-ai/memcode ↩ 回到正文 · back to text
- 17 RCA-lab. GitHub repositoryhttps://github.com/coroot/rca-lab ↩ 回到正文 · back to text
- 18 Mocktailhttps://getmocktail.com/ ↩ 回到正文 · back to text
- 19 E3d-pilot. GitHub repositoryhttps://github.com/spacepacket1/e3d-pilot ↩ 回到正文 · back to text
- 20 Mole. GitHub repositoryhttps://github.com/lajosdeme/mole ↩ 回到正文 · back to text
- 21 LuaCADhttps://luacad.ad-si.com ↩ 回到正文 · back to text
- 22 Graft. GitHub repositoryhttps://github.com/NanoNets/Graft ↩ 回到正文 · back to text
- 23 Self-bench. GitHub repositoryhttps://github.com/mupt-ai/self-bench ↩ 回到正文 · back to text
- 24 Hexis. GitHub repositoryhttps://github.com/Bevel-Software/Hexis ↩ 回到正文 · back to text
- 25 Shoehorn. GitHub repositoryhttps://github.com/notactuallytreyanastasio/shoehorn ↩ 回到正文 · back to text
- 26 Easel. GitHub repositoryhttps://github.com/The-Sentience-Company/easel ↩ 回到正文 · back to text
- 27 Remarc. GitHub repositoryhttps://github.com/metedata/Remarc ↩ 回到正文 · back to text
- 28 MCP-stama. GitHub repositoryhttps://github.com/StamManif/mcp-stama ↩ 回到正文 · back to text
- 29 Lumabri. GitHub repositoryhttps://github.com/JustVugg/lumabri ↩ 回到正文 · back to text
- 30 OpenAnalytics. GitHub repositoryhttps://github.com/OpenLabs-so/openanalytics ↩ 回到正文 · back to text
- 31 Qwen3.8-27Bhttps://huggingface.co/Qwen/Qwen3.8-27B-FP8 ↩ 回到正文 · back to text
- 32 GLM-5.3: Frontier coding with emergent cyber capabilitieshttps://z.ai/blog/glm-5.3 ↩ 回到正文 · back to text
- 33 DeepSeek peak/off-peak pricing updatehttps://api-docs.deepseek.com/news/news260813/ ↩ 回到正文 · back to text
- 34 How Google is making private AI practical with homomorphic encryptionhttps://blog.google/security/how-google-is-making-private-ai-practical-with-homomorphic-encryption/ ↩ 回到正文 · back to text
- 35 How Claude's text watermarking workshttps://www.anthropic.com/news/claude-text-watermark ↩ 回到正文 · back to text
- 36 Anthropic Risk Report - August 2026https://www-cdn.anthropic.com/f61d49fa5596956a5dec75fea0e973bf6a6a8378/Redacted%20Risk%20Report%20August%202026%20.pdf ↩ 回到正文 · back to text
- 37 Maximizing the value of your Claude Code sessionshttps://claude.com/blog/maximizing-the-value-of-your-claude-code-sessions ↩ 回到正文 · back to text
- 38 Mistral OCR 4.1https://docs.mistral.ai/models/ocr-4-1 ↩ 回到正文 · back to text
- 39 Bluesky Protocol Serviceshttps://atproto.com/blog/introducing-bluesky-protocol-services ↩ 回到正文 · back to text
- 40 RustDesk now supports true unattended remote access on Waylandhttps://rustdesk.com/blog/unattended-remote-access-wayland/ ↩ 回到正文 · back to text
- 41 Firefox is now the last major browser that still supports uBlock Originhttps://www.pcworld.com/article/3212428/firefox-is-now-the-last-major-browser-that-still-supports-ublock-origin.html ↩ 回到正文 · back to text
- 42 France's top court blocks social media ban for under-15shttps://www.reuters.com/world/frances-top-court-rules-social-media-ban-curtails-freedom-expression-2026-08-14/ ↩ 回到正文 · back to text
- 43 Z.ai Security Disclosurehttps://cvd.z.ai ↩ 回到正文 · back to text
- 44 Nine PBS sues Iron Mountain over blocked access to archival datahttps://current.org/2026/08/nine-pbs-sues-iron-mountain-over-blocked-access-to-archival-data/ ↩ 回到正文 · back to text
- 45 Everything is about to “go dark”https://blog.cryptographyengineering.com/2026/08/14/everything-is-about-to-go-dark/ ↩ 回到正文 · back to text
- 46 What You Gain by Building Your Own Game Enginehttps://eliasfarhan.ch/gamedev/cpp/2026/08/14/srnative-01-why-a-custom-engine.html ↩ 回到正文 · back to text
- 47 ActivityPub Won by Being Boringhttps://o.ee/blog/activitypub-won-by-being-boring/ ↩ 回到正文 · back to text
- 48 RISC-V: They Should Have Known Betterhttps://dmitry.gr/?r=06.%20Thoughts&proj=12.%20RV ↩ 回到正文 · back to text
- 49 There Is Still No Silver Bullethttps://cekrem.github.io/posts/there-is-still-no-silver-bullet/ ↩ 回到正文 · back to text
- 50 Why does Opus 5 feel worse to work with?https://mun-logadan.github.io/why-does-opus-5-feel-worse/ ↩ 回到正文 · back to text
- 51 Where did the old web go?https://0.mk/blog/link-rot ↩ 回到正文 · back to text
- 52 Choosing an AI model: one prompt, 11 models, different resultshttps://www.netlify.com/blog/one-prompt-11-models-very-different-results/ ↩ 回到正文 · back to text
- 53 Understanding is the new bottleneckhttps://www.geoffreylitt.com/2026/07/02/understanding-is-the-new-bottleneck ↩ 回到正文 · back to text
- 54 Choose Boring Technologyhttps://mcfunley.com/choose-boring-technology ↩ 回到正文 · back to text
- 55 Curl Performancehttps://daniel.haxx.se/blog/2026/08/14/curl-performance-2/ ↩ 回到正文 · back to text
- 56 Blog about things you don't understand yethttps://www.seangoedecke.com/blog-about-things-you-dont-understand-yet/ ↩ 回到正文 · back to text
- 57 Comments in the code vs PR descriptionhttps://devblogs.microsoft.com/oldnewthing/20260812-00/?p=112607 ↩ 回到正文 · back to text
- 58 I turned my RSS feeds into an e-ink newspaperhttps://heyjonny.dev/posts/rss-to-eink-newspaper/ ↩ 回到正文 · back to text
- 59 sqlite-utils 4.2https://simonwillison.net/2026/Aug/13/sqlite-utils/ ↩ 回到正文 · back to text
- 60 unslothai/unsloth. GitHub repositoryhttps://github.com/unslothai/unsloth ↩ 回到正文 · back to text
- 61 holaboss-ai/holaOS. GitHub repositoryhttps://github.com/holaboss-ai/holaOS ↩ 回到正文 · back to text
- 62 kepano/obsidian-skills. GitHub repositoryhttps://github.com/kepano/obsidian-skills ↩ 回到正文 · back to text
- 63 NVIDIA-NeMo/Automodel. GitHub repositoryhttps://github.com/NVIDIA-NeMo/Automodel ↩ 回到正文 · back to text
- 64 lightningpixel/modly. GitHub repositoryhttps://github.com/lightningpixel/modly ↩ 回到正文 · back to text
- 65 PrimeIntellect-ai/prime-agent. GitHub repositoryhttps://github.com/PrimeIntellect-ai/prime-agent ↩ 回到正文 · back to text
- 66 3b1b/manim. GitHub repositoryhttps://github.com/3b1b/manim ↩ 回到正文 · back to text
- 67 calcom/cal.diy. GitHub repositoryhttps://github.com/calcom/cal.diy ↩ 回到正文 · back to text
- 68 apify/apify-mcp-server. GitHub repositoryhttps://github.com/apify/apify-mcp-server ↩ 回到正文 · back to text
- 69 golbin/hop. GitHub repositoryhttps://github.com/golbin/hop ↩ 回到正文 · back to text
- 70 kenforthewin/atomic. GitHub repositoryhttps://github.com/kenforthewin/atomic ↩ 回到正文 · back to text
- 71 megadose/holehe. GitHub repositoryhttps://github.com/megadose/holehe ↩ 回到正文 · back to text