最近的研究表明,Google Chrome通过其用户体验报告(CrUX)发布的百万最受欢迎网站列表比其他热门列表(如Alexa百万热门和Tranco百万热门)更为准确。
本仓库缓存了从Google BigQuery的CrUX数据中查询的Chrome热门网站的CSV版本。您可以在这里浏览所有缓存的列表。最新的全球百万热门网站可以直接在以下链接下载: https://raw.githubusercontent.com/zakird/crux-top-lists/main/data/global/current.csv.gz。
CrUX数据集与其他热门列表有几个重要区别:
网站按排名量级分类,而非具体排名。提供的文件中的排名将是1000、10K、100K或1M。数据按排名量级排序。在每个量级内,网站是随机列出的。
数据每月发布一次,通常在每月的第二个星期二。
以下是数据的示例:
origin,rank
https://www.ptwxz.com,1000
https://ameblo.jp,1000
https://danbooru.donmai.us,1000
https://game8.jp,1000
https://www.google.com.au,1000
https://www.repubblica.it,1000
https://www.w3schools.com,1000
https://animekimi.com,1000
网站根据完成的页面加载量(通过首次内容绘制来衡量)进行排名,并按网站源进行汇总。该数据集尽可能贴近用户主动发起的页面加载(例如,它排除了来自iframe的流量)。有关CrUX及其数据收集方法的更多信息可以在其官方网站上找到:https://developer.chrome.com/docs/crux/about/。
本仓库并不包含Chrome发布的所有网站排名数据。他们的全球热门网站列表包含约1500万个网站。百万热门网站覆盖了Chrome用户超过95%的流量,无论是按页面加载量还是页面停留时间计算(Ruth等人),这是一个合理的近似:
<p align="center"> <img width="500" alt="用户流量CDF" src="https://yellow-cdn.veclightyear.com/835a84d5/fbedfbba-0278-49a9-803c-93710ee4b55f.png"> </p>如果您想使用更多或更少的网站,以下是大致的覆盖率:
| 网站数量 | 页面加载量 |
|---|---|
| 1000 | 50% |
| 10K | 70% |
| 100K | 87% |
| 1M | 95% |
| 5M | 99% |
以下SQL可用于生成类似的全球热门网站列表:
SELECT distinct origin, experimental.popularity.rank FROM `chrome-ux-report.experimental.global` WHERE yyyymm = ? -- 例如,整数202210 GROUP BY origin, experimental.popularity.rank ORDER BY experimental.popularity.rank;
Ruth等人的研究还表明,浏览行为具有本地化特征,全球热门列表倾向于全球性网站(如科技和游戏),而不是本地网站(如教育、政府和金融)。因此,研究人员可能还想调查趋势是否在各个国家都成立。
<p align="center"> <img width="500" alt="网站偏差" src="https://yellow-cdn.veclightyear.com/835a84d5/98159733-3ccb-4d98-8a82-e8ebc4c5a9a5.png"> </p>Chrome在BigQuery中发布了特定国家的热门列表,以下SQL可用于导出特定国家的热门网站:
SELECT distinct country_code, origin, experimental.popularity.rank FROM `chrome-ux-report.experimental.country` WHERE yyyymm = ? -- 例如,整数202210 AND experimental.popularity.rank <= 1000000 GROUP BY country_code, origin, experimental.popularity.rank ORDER BY country_code, experimental.popularity.rank;
CrUX数据集基于从Google Chrome收集的数据,因此对Chrome使用有限的国家(如中国)存在偏差。如果您特别关注中国的域名热度,可以考虑参考《构建开放、健壮和稳定的基于投票的域名热门列表》,该研究基于从中国大型DNS提供商114DNS收集的数据。
本仓库中的数据全部由Google公开发布到其BigQuery中的CrUX数据集。这只是该公开数据的缓存。本README中的许多论点基于两篇最近的研究论文。第一篇描述了我们如何评估热门网站列表的准确性。第二篇是对网络浏览行为的广泛研究。
颠覆热门列表:评估热门网站列表的准确性<br/> Kimberly Ruth, Deepak Kumar, Brandon Wang, Luke Valenta, 和 Zakir Durumeric<br/> ACM互联网测量会议 (IMC),2022年10月
全球网络浏览的全球视角<br/> Kimberly Ruth, Aurore Fass, Jonathan Azose, Mark Pearson, Emma Thomas, Caitlin Sadowski, 和 Zakir Durumeric<br/> ACM互联网测量会议 (IMC),2022年10月


AI一键生成PPT,就用博思AIPPT!
博思AIPPT,新一代的AI生成PPT平台,支持智能生成PPT、AI美化PPT、文本&链接生成PPT、导入Word/PDF/Markdown文档生成PPT等,内置海量精美PPT模板,涵盖商务、教育、科技等不同风格,同时针对每个页面提供多种版式,一键自适应切换,完美适配各种办公场景。


AI赋能电商视觉革命,一站式智能商拍平台
潮际好麦深耕服装行业,是国内AI试衣效果最好的软件。使用先进AIGC能力为电商卖家批量提供优质的、低成本的商拍图。合作品牌有Shein、Lazada、安踏、百丽等65个国内外头部品牌,以及国内10万+淘宝、天猫、京东等主流平台的品牌商家,为卖家节省将近85%的出图成本,提升约3倍出图效率,让品牌能够快速上架。


企业专属的AI法律顾问
iTerms是法大大集团旗下法律子品牌,基于最先进的大语言模型(LLM)、专业的法律知识库和强大的智能体架构,帮助企业扫清合规障碍,筑牢风控防线,成为您企业专属的AI法律顾问。


稳定高效的流量提升解决方案,助力品牌曝光
稳定高效的流量提升解决方案,助力品牌曝光


最新版Sora2模型免费使用,一键生成无水印视频
最新版Sora2模型免费使用,一键生成无水印视频


实时语音翻译/同声传译工具
Transly是一个多场景的AI大语言模型驱动的同声传译、专业翻译助手,它拥有超精准的音频识别翻译能力,几乎零延迟的使用体验和支持多国语言可以让你带它走遍全球,无论你是留学生、商务人士、韩剧美剧爱好者,还是出国游玩、多国会议、跨国追星等等,都可以满足你所有需要同传的场景需求,线上线下通用,扫除语言障碍,让全世界的语言交流不再有国界。


选题、配图、成文,一站式创作,让内容运营更高效
讯飞绘文,一个AI集成平台,支持写作、选题、配图、排版和发布。高效生成适用于各类媒体的定制内容,加速品牌传播,提升内容营销效果。


AI辅助编程,代码自动修复
Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。


最强AI数据分析助手
小浣熊家族Raccoon,您的AI智能助手,致力于通过先进的人工智能技术,为用户提供高效、便捷的智能服务。无论是日常咨询还是专业问题解答,小浣熊都能以快速、准确的响应满足您的需求,让您的生活更加智能便捷。


像人一样思考的AI智能体
imini 是一款超级AI智能体,能根据人类指令,自主思考、自主完成、并且交付结果的AI智能体。
最新AI工具、AI资讯
独家AI资源、AI项目落地

微信扫一扫关注公众号