XCRAP.CC

为什么会有这东西

2023 年,X 关掉了免费 API,然后把替代方案定价到每月 $200,而这一档仍然读不了大部分帖子。一个月后,x.com 开始让未登录的读者看两条帖子就去登录。

被伤到的不是那些付得起钱的人。是学生、研究者、爱好者,还有数量庞大的小型 AI 工具——它们只需要读几条公开帖子,现在却读不到了。

XCrap 是对这件事最小的一个回答。它读的是任何人在浏览器里都能读的页面,再以模型能用的形状还回去。它就干这些。

谁真的在用

做智能体的人

流量的大头。智能体在对话里拿到一个链接,需要链接背后的帖子——正文、数据、它所属的长贴——而不需要一份要运营方去买、去存、去轮换的凭证。

研究者

研究一个说法如何扩散的论文,预算里没有每月 200 美元这一项。四十个学生每人要抓两百条帖子交作业,也没有。

记者和存档者

报道里引用的帖子,在账号被删、改名或封禁之后仍应可读。把它读成 Markdown 并留存,就是信源和死链的区别。

任何收到链接的人

把地址栏里的 x.com 换成 xcrap.cc,直接读。不用账号,不用装应用,没有两条就停的限制,也没有让你登录的弹层。

它不会做什么

它不会读任何私密内容

受保护账号、私信、任何藏在个人登录背后的东西。XCrap 只读取公开账号:它们的帖子、个人资料、帖子下的回复,以及关注者列表。

它不会留着你的数据

帖子缓存五天后删除。媒体是流式转发的,从不写进磁盘。这里没有可以被传唤、也没有可以被泄露的档案库。

它不会以后再来收你的钱

没有密钥要生成,所以也没有密钥可以拿来开始计费。哪天运营成本覆盖不住了,诚实的做法是直说,而不是加一道付费墙。

它不会跟退出请求争辩

你要求被排除,你就被排除,当天生效,不用填表,也不用给理由。

该说说我们怎么想的了

X 在 2023 年关掉了免费 API,给替代品定的价让读公开帖子变成了一笔公司开支。给出的理由是:这些数据太值钱,不能白送。

它被白送了——送给了 Grok。学生免费读不到的那些公开帖子,正在训练并支撑同一家公司的聊天机器人,再以订阅的形式卖回给你,作为关于你不被允许读的那些帖子的答案。这些数据从来不是太值钱不能白送,而是太值钱不能让别人拿到。

X 的条款如今禁止任何人使用 X 上发布的帖子训练 AI,而由 X 的母公司 xAI 打造的 Grok 却正是用这些帖子训练的。埃隆·马斯克把 X 的内容扣作人质,只留给一个 AI:唯一获准学习数百万人公开发布内容的模型,属于平台所有者本人。想象一下,如果 Reddit 把用户免费写下的十五年讨论对所有其他 AI 关闭,只留给自己的聊天机器人。没有人会称之为保护数据。这是据为己有,而且不公平。

所以:不。公开就是公开。一条写在公开时间线上的帖子,一年前未登录的浏览器就能打开,不会因为买下这栋楼的人一句话就变成专有资产。XCrap 读任何人都能读到的东西,再以你真能用的形状还给你。整个论点就是这样,我们不为此道歉。

但这都不是可以随便乱来的理由。上一节说的仍然成立:不碰私密内容,不留存,收到退出请求当天就照办。反对收费墙,不等于反对墙后面的人。

跑起来要多少钱

一个域名和一台服务器,预算就这些。没有广告、没有付费档、没有投资人,也没有以后要向你追加售卖的东西。靠捐助覆盖;哪天覆盖不住了,诚实的做法是直说,而不是悄悄加一道收费墙。

捐赠

关于这个名字

X、scrape,还有那个显而易见的第三个词。凌晨两点的时候觉得更好笑,等回过神来域名已经买好了。