这是一个不断更新的仓库,记录了个人在学习数据科学、 机器学习相关主题方面的旅程。
目标: 以Jupyter Notebook格式介绍机器学习内容。内容旨在在数学符号、从头开始使用Python科学库(包括numpy,numba,scipy,pandas,matplotlib,pyspark等)的教育实现与开源库的使用(如scikit-learn,fasttext,huggingface,onnx,xgboost,lightgbm,pytorch,keras,tensorflow,gensim,h2o,ortools,ray tune等)之间取得良好平衡。
精选深度学习笔记。
与广告领域相关的笔记。
信息检索,部分示例使用ElasticSearch进行演示。
用于基于时间序列数据的预测方法。
端到端项目包括数据预处理,模型构建。
A/B 测试,即实验设计。包括:必要统计概念的快速回顾。进行测试的方法和流程/思维过程以及需注意的陷阱。
选择、改进、评估模型/算法的方法。
降维方法。
推荐系统,侧重矩阵分解方法。新手应先通过第一个笔记本了解矩阵分解方法的基础知识。
树模型,用于回归和分类任务。
TF-IDF 和主题建模是专门用于文本分析的技术。
对那些感兴趣的人也有一个 keras 速查表 可能会派上用场。
文本分类的深度学习技术被分类在自己的一节中。
使用 scikit-learn 构建对岭回归和套索回归的直观理解。
也讨论了除了 networkx 之外的图库。
也称为市场篮分析。
探索大数据工具,如 Spark 和 H2O.ai。对于那些感兴趣的人,还有一个 pyspark rdd 速查表 和 pyspark dataframe 速查表 可能会派上用场。
在 Python 中进行数据科学的最佳实践。
遗传算法。从零开始的无数学解释和代码。
在您的数据集中包含不平衡的二元类时,使用成本敏感错误(意味着两类之间的误分类成本可能不同)为逻辑回归选择最佳截断值。例如,数据集中大多数数据点具有正面结果,而很少有负面结果,或者相反。这种概念可以扩展到任何其他可以预测类概率的分类算法,此文档仅使用逻辑回归进行说明。
一系列散落的R中的旧聚类文档。


免费创建高清无水印Sora视频
Vora是一个免费创建高清无水印Sora视频的AI工具


最适合小白的AI自动化工作流平台
无需编码,轻松生成可复用、可变现的AI自动化工作流

大模型驱动的Excel数据处理工具
基于大模型交互的表格处理系统,允许用户通过对话方式完成数据整理和可视化分析。系统采用机器学习算法解析用户指令,自动执行排序、公式计算和数据透视等操作,支持多种文件格式导入导出。数据处理响应速度保持在0.8秒以内,支持超过100万行数据的即时分析。


AI辅助编程,代码自动修复
Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。


AI论文写作指导平台
AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。


AI一键生成PPT,就用博思AIPPT!
博思AIPPT,新一代的AI生成PPT平台,支持智能生成PPT、AI美化PPT、文本&链接生成PPT、导入Word/PDF/Markdown文档生成PPT等,内置海量精美PPT模板,涵盖商务、教育、科技等不同风格,同时针对每个页面提 供多种版式,一键自适应切换,完美适配各种办公场景。


AI赋 能电商视觉革命,一站式智能商拍平台
潮际好麦深耕服装行业,是国内AI试衣效果最好的软件。使用先进AIGC能力为电商卖家批量提供优质的、低成本的商拍图。合作品牌有Shein、Lazada、安踏、百丽等65个国内外头部品牌,以及国内10万+淘宝、天猫、京东等主流平台的品牌商家,为卖家节省将近85%的出图成本,提升约3倍出图效率,让品牌能够快速上架。


企业专属的AI法律顾问
iTerms是法大大集团旗下法律子品牌,基于最先进的大语言模型(LLM)、专业的法律知识库和强大的智能体架构,帮助企业扫清合规障碍,筑牢风控防线,成为您企业专属的AI法律顾问。


稳定高效的流量提升解决方案,助力品牌曝光
稳定高效的流量提升解决方案,助力品牌曝光


最新版Sora2模型免费使用,一键生成无水印视频
最新版Sora2模型免费使用,一键生成无水印视频
最新AI工具、AI资讯
独家AI资源、AI项目落地

微信扫一扫关注公众号