一位 FOSS 应用维护者做了一件多数人只想不做的事:把 9 月 12 日 F-Droid 推送更新的全部 102 款应用挨个翻了一遍代码仓库,按 AI 参与程度评级。结果不意外,但比想象更极端:74 款(72.5%)被判定为主要由 AI 编写,只有 18 款(17.6%)几乎看不到 AI 参与的迹象,剩下 10 款(9.8%)难以归类。
判定方法:没有检测器,只有「气味」
作者在开篇就承认:文本本身携带的元信息不足以支撑精确检测,没人能真造出「slop 检测器」。他的方案是一套粗糙的三档体系——「主要是 AI / 难说·主要是人 / 无 AI 迹象」,依据是近期提交的内容、仓库外观和项目痕迹:README 是不是懒得写、代码评审是不是交给 LLM 自己做、仓库里有没有 Claude Code 和 Codex 这类自动化基础设施。任何带 agentic 基础设施的仓库被直接归入「主要是 AI」,作者的理由是:他不相信有人能在编码智能体框架里「负责任地」使用 AI。评级只看近期提交、不翻项目历史——多年老应用,只要近期提交是 LLM 风格,照样归入「主要是 AI」。作者同时坦承判断会有误差,且明确没做代码质量分析。
数字之外,几个更扎眼的细节
托管在 Codeberg 上的 5 款应用中有 4 款被判定为主要由 AI 生成——而 Codeberg 已经宣布 AI 政策、禁止此类应用,清除显然还需要时间。一位名为 brandonp2412 的用户在本批更新里维护了多款应用,全部是纯 vibe-code,且散落在 com.presley.* 、com.codesail.* 等互不相关的命名空间下;作者猜测,这要么是一位极高产的 vibe-coder,要么是被赋予了 GitHub 账号的智能体。评级清单里也不乏知名项目:Yubico Authenticator 被判「主要是 AI」;维基百科官方应用反而因为提交大多像人写的、只是仓库里有大量 Claude 基础设施,被归为「主要是人」——连作者都意外。还有一对用「Don't tread on me」旗标做品牌的应用,开发多年,所有改动竟然都是用 GitHub 网页文件编辑器完成的,连 git 都没用。
这是「量化 AI 含量」脉络的又一格
放进大坐标系看,它是「给某个内容生态测 AI 含量」的最新一格:皮尤研究中心此前抽样发现,ChatGPT 发布后的英文网页里超过三分之一带 AI 写作痕迹;对生物医学论文库的统计给出的比例更高。网页、论文、现在的 Android 开源应用代码——三个生态,量级趋同。这次的特殊之处在于对象是代码:代码有编译器和运行时兜底,「AI 写的」在应用商店语境里不直接等于不可用。作者也保留了这份清醒——他承认 LLM 极其有用,盘点完还发现自己常用的几款 FOSS 应用同样有重度 LLM 痕迹:「我还会继续用它们,因为它们确实好用,但整个实验让我心情相当矛盾。」
所以呢
这份盘点真正的价值不是「72.5%」这个数字,而是它把一个体感问题变成了可讨论的公共事实。对 F-Droid 和 Codeberg 这类社区基础设施,政策写了是一回事,审核有没有能力消化这个比例是另一回事。对开发者,一条低成本的正路已经出现:清单里至少有一款应用(Bati)在 README 里直接写明 AI 参与情况,被作者标注「Thanks for making it easy」——披露本身就是最便宜的信任信号。对用户,「开源」这个标签正在悄悄降级:它过去隐含「人写的、可审计」,现在只承诺「源码可看」。源码可看,和有人对它负责,是两件事。
参考:tintotint.eu 分析(whacky-corner/f-droid_slop);Solidot sid 85385