这个站的域名叫 sensedawn.com。买它之前,我对着 Verisign 和 IdentityDigital 的官方 RDAP 接口发了 35148 次查询。
不是因为挑剔。是因为第一轮 69 个候选全军覆没之后,我意识到自己对域名市场的认知是错的。
十五个批次,35148 个候选,10117 个可注册。
| 批次 | 查询 | 可注册 | 可用率 |
|---|---|---|---|
| AI/出海英文词组合 | 69 | 0 | 0% |
纯拼音 .com |
25 | 0 | 0% |
| 真实单词(希腊/拉丁/太空/航空/影视/具身智能) | 296 | 3 | 1.0% |
| 神话专名/天文星名/日语/北欧语纯词 | 330 | 4 | 1.2% |
英文 .ai |
55 | 2 | 3.6% |
| 航海隐喻 + 动词前缀 | 65 | 6 | 9.2% |
| 热门长词 + 短词拼接 | 4188 | 470 | 11.2% |
| 直白 AI 词组合 | 3810 | 506 | 13.3% |
| 可念熟词 + 动物意象 | 6964 | 1441 | 20.7% |
| 品牌造词 + 赛道组合 | 1613 | 400 | 24.8% |
| 美词截断变形 | 3698 | 1149 | 31.1% |
| 词根拼接造词 | 1246 | 420 | 33.7% |
| 意象词两词/三词组合 | 3539 | 1352 | 38.2% |
| AI 意象组合 | 5173 | 2250 | 43.5% |
| AI 缩写词组合 | 4040 | 2108 | 52.2% |
把这张表按可用率排一下,会看到一条非常干净的曲线:
越是"词典里有的词",可用率越接近 0;越是"词典里没有的词",可用率越接近 50%。
这不是巧合,这就是结论本身。
我原本以为,冷僻词还有机会。于是扫了 296 个真实单词——不是 cloud、data 这种,是我特意从希腊语、拉丁语、天体力学、航空工程、电影胶片工艺、机器人学里挑出来的冷僻词。
296 个里剩下 3 个。
被注册掉的包括这些:
praxinoscope(活动视镜,1877 年的动画装置)orthochromatic(正色性的,一种胶片感光特性)backdrivable(可反向驱动的,机器人关节术语)interoception(内感受,神经科学)apoastron(远星点,双星轨道术语)然后我换了个方向,去扫神话专名、天文星名、日语美学词、北欧语——想着这些至少不在英文词典里。330 个,剩下 4 个,而且全是 fracastorius、circumzenithal 这种没法当品牌用的长词。
没了的包括:
smultronstalle(瑞典语,"野草莓地",指一个人心里那个不为人知的秘密去处)heiligenschein(德语,露珠在草地上形成的圣光晕)revontulet(芬兰语,北极光,字面是"狐狸的火")komorebi(日语,木漏れ日,阳光穿过树叶的光斑)这些词的 .com 全部有主。 不是被某个热爱瑞典语的人注册的——是被程序批量扫走的。域名投资者早就把全世界所有语言的词典都跑了一遍。
所以第一个结论是:"找一个还没被注册的好听的词"这件事,在 2026 年已经不存在了。 不管你翻哪本词典,哪门语言。
真正有意思的发现,在反过来看的时候。
我扫的每一批组合里,有些词几乎在每个可用组合里都出现,有些词一个都没剩。这个分布不是随机的——它是域名投资者词表的负片。
一批"意象词 + 角色词"的组合(skynomad 那种构词法)扫下来:
forge(锻造)—— 60 个搭配里一个都没剩pilot、scout —— 只剩 5 个和 2 个nomad —— 剩 18 个envoy(使者)、herald(传令者)、refuge(庇护所)—— 几乎全在再看一批 AI 相关的:
agent —— 0 个可用smart —— 1 个brain —— 4 个emerge(涌现)—— 80 多个可用emerge 这个词特别说明问题。对大模型领域来说,"涌现能力"(emergent abilities)是最核心的概念之一;同时它就是一个普通英文词,普通人也认识。它按理说不该有货。
但它有货,因为域名投资者的词表是按"通用商业价值"排序的,他们不懂垂直领域。同样的还有 gyro(陀螺仪——无人机和具身智能的核心部件)、kite(风筝——低空经济的天然意象)、helix(螺旋)。这些词在通用商业语境里平平无奇,在特定赛道里是核心词。
这就是唯一还剩下的套利空间:你比爬虫更懂你自己的行业。
这一段才是我真正想记下来的。
扫到中后段,我一直在找"既有意象又不冷僻"的词,把 llm、gpt、rag 这类当下天天在说的缩写完全漏掉了。有人随手搜了一下 llmdawn.com,还在。
我第一反应是"那我扫一遍"。扫完之后,llm 系统里只出现了 4 个可用组合,而且 llmdawn 不在其中。
它压根没进过扫描队列。
原因是我在生成候选时写了一个可读性过滤器,其中一条规则是「不允许四个连续辅音」——用来挡掉 thalassyx 那种没法念的东西。而 llmdawn 的前四个字母是 l-l-m-d,四个辅音,被直接丢弃。gpt 系同理,所有 gpt + 辅音开头的组合全部消失。
这条规则本身没错:缩写是按字母读的(L-L-M-dawn),它不该套用给单词设计的音节规则。错的是我让一个自动过滤器替我做了判断,而它不会告诉我它删了什么。
修掉规则重扫,同一批词出来 2108 个可用,可用率 52.2%——是所有批次里最高的。
这个教训比域名本身有价值得多:
任何自动筛选都在替你做判断。它的输出你看得见,它丢掉的东西你看不见。 当结果不符合直觉时,先怀疑筛选器,而不是先怀疑世界。
我当时给出的结论是"AI 相关的好域名已经没了",而真相是"我的正则表达式把它们全删了"。如果没有人随手搜那一下,这个错误结论会一直站着。
顺便说下方法,因为它很简单,任何人都能复现。
查域名是否被注册,别用 whois——输出格式各家不同,还有速率限制。用 RDAP(Registration Data Access Protocol),它是 ICANN 强制要求的标准接口,返回 JSON,语义明确:
各顶级域的 RDAP 端点从 IANA 的官方 bootstrap 文件拿,不要猜:
curl -s https://data.iana.org/rdap/dns.json
常用的几个:
.com/.net https://rdap.verisign.com/com/v1/domain/{name}
.ai https://rdap.identitydigital.services/rdap/domain/{name}
.dev/.app https://pubapi.registry.google/rdap/domain/{name}
一个最小的批量查询:
check() {
code=$(curl -s -o /dev/null -w "%{http_code}" --max-time 20 \
"https://rdap.verisign.com/com/v1/domain/$1.com")
[ "$code" = "404" ] && echo "可注册 $1.com"
}
export -f check
cat names.txt | xargs -P 16 -I{} bash -c 'check {}'
并发 16 到 20 是安全的,实测 6964 个候选跑完约 9 分钟。
一定要加一条对照测试:拿一个随机乱码域名去查,确认它返回 404。我扫到一批 69 个候选全部返回"已被占"时,第一反应是脚本坏了——查了乱码域名确实返回 404,才确认那 69 个是真的全没了。结果太整齐的时候,先验证工具。
sensedawn.com 是 sense + dawn:先感知,后破晓。两个词都是最基础的英语,不用解释,也不绑定任何一代技术。
它能被我买到,唯一的原因是:在爬虫眼里,它不值钱。
这也是我从三万五千次查询里得到的最实在的一条:
你现在能买到的每一个域名,都是被程序看过一眼、判断"没有商业价值"之后放过的。 所以不要指望域名本身升值。它的价值,100% 来自你往上面注入了什么。
买域名这件事,唯一值得花的时间是想清楚要做什么。剩下的,四十分钟和四十小时的结果不会有本质差别——我花了后者,所以可以负责地这么说。
← 回到首页