67%的"中国出口品牌"服务于llms.txt. 我们读他们。 多数是空的.

2026年8月10日2 次浏览来源:Dev.to阅读原文

对59个中国跨境品牌网站的扫描发现,没有屏蔽了审调局-SearchBot,67.4%服务于llms.txt文件,只有1.9%搭载了FAQPage schema.

但当我们打开llms.txt文件时,五分之四没有包含任何品牌信息——它们都是关于支付协议的Shopify平台模板.

门开而入而入而入而入而入而入而入而入而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出之而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出而出于于于于于于于于于于于于于于 原始数据和扫描脚本如下。

本系列的首篇文章扫描了100个AI工具网站,并发现了一些反直觉的东西:几乎没有人屏蔽AI搜索爬行者,但业界正在检查错误的.

该扫描明确注意到一个限制:"无论DTC品牌或制造出口商的相同持有量是这个样本无法回答的另一个问题".

这篇文章回答了这个问题。

我们扫描了59个中国品牌, 当有人问ChatGPT“什么是适合露营的便携式发电站?” 结果与我的预期不符,而且我计划检查的衡量标准中都没有真正的发现。

抽样59个中国跨境品牌域分18个产品类别:消费电子,智能家用,便携式电能,DTC时装,美容,室外齿轮,LED显示器,3D打印机,数字平板电脑,电子自行车,投影机,智能宠物设备,音频,崎岖手机,可穿戴.

大约三分之一是知名的名字:Anker,SHEIN,Roborock,EcoFlow,Govee.

其余为中层品牌——Tribit, Blackdeer, Oukitel, Fiido, Engwe——这种品牌从AI能见度中获益最大,但不太可能有一个专门的AI-SEO人物.

在59人中,53人返回了自己的主页(HTTP 200). 2返回了403,4没有连接(DNS超时或中止).

下方的每个度量标准只使用该具体信号最终可以读取的地点——不是59个,不是53个,而是每个表格中注明的每个度量标准。

与第一篇文章相同的扫描脚本:零LLM呼叫,失败被记录为出错,没有默认被伪装为数据.

发现1:这里没有人阻断AI搜索爬行器 无论是Crawler AI工具(n=68) 出口品牌(n=47) 审调处-SearchBot(ChatGPT搜索) 0% ChatGPT-用户(活取) 0% GPTBot(培训) 0% 2.1% ClaudeBot 5.9% Persplexity Bot 1.5% Google-Exted 5.9% 2.1% CCBot 7.4% 2.1% 字节蜘蛛 5.1% 封锁率甚至低于AI公司.

只有一款品牌——一款3D打印机制造机"Elegoo"-屏蔽了GPTBot,它让审调局-SearchBot开通.

这与第一次扫描时的故意和知情模式相同:选择退出培训数据,留在搜索索引中。

对于仍然担心"偶然爬行者屏蔽"作为重大风险的任何人:在两个非常不同的人群的159个站点的综合样本中,零屏蔽审调局-SearchBot. 0块 ChatGPT用户.

门已开.

那么,问题就是门后面是什么。

发现2:67%服务于llms.txt.

其多为空.

在43个网站中,有29个网站提供了档案——67.4%。

这几乎是人工智能本土工具中38.8%的两倍。

我最初的反应是 中国的出口品牌 不知何故领先。

数据看起来很干净 文件已经存在 。

扫描仪证实它不是一个 HTML 错误页 。

然后我读了文件。

我从Anker、Florasis、Tribit、Blackdeer和Oukitel等五个品牌中提取了实际的txt内容。 5个中4个包含相同文本: 参考"Shop swill"和"UCP协议" 支付处理指令的终点 关于"未经授权购买"零产品名.

零品牌定位.

一个AI模型可以用来回答"这个品牌卖什么?"的零信息.

这是Shopify平台模板。

文件之所以存在 是因为Shoppify把它放在那里 而不是因为品牌里有人写的 唯一的例外是安克 它的llms.txt描述了该品牌的定位,列出了8个产品分类

分享