个性化阅读
专注于IT技术分析

机器学习 第17页

R中的双变量分布热图

半瓶木阅读(2220)评论(0)赞(0)

本文概述 教程目标 自行车共享数据集 功能选择 直方图 将双变量分布拟合到你的数据 热图 总结 作为数据科学家, 你将必须分析数据集中要素的分布。通常, 这是通过使用直方图完成的, 这对于显示值的可变范围, 其偏差以及值集中的位置非常有用。...

使用Scikit学习进行KNN分类-srcmini

使用Scikit学习进行KNN分类

半瓶木阅读(1554)评论(0)赞(0)

本文概述 K最近邻 KNN算法如何工作? 渴望与懒惰的学习者 维度诅咒 你如何确定KNN中的邻数量? Scikit-learn中的分类器构建 优点 缺点 如何改善KNN? 总结 K最近邻(K Nearest Neighbor, KNN)是一...

制作CSV格式数据集:图像数据集-srcmini

制作CSV格式数据集:图像数据集

半瓶木阅读(3262)评论(0)赞(1)

在机器学习, 深度学习, 数据科学中, 最常用的数据文件是json或CSV, 这里我们将学习CSV并将其用作数据集。 CSV代表逗号分隔值。这些数据库字段已导出为包含一行的格式, 其中用逗号分隔每个数据库记录。扩展名为.csv的文件与纯文本...

DBSCAN:Python的宏观调查-srcmini

DBSCAN:Python的宏观调查

半瓶木阅读(1201)评论(0)赞(0)

简而言之, 群集是将一组对象组合在一起的任务, 以使同一群集中的对象彼此之间的相似性高于其他群集中的对象。相似度是反映两个数据对象之间关系强度的量。聚类主要用于探索性数据挖掘。群集在机器学习, 模式识别, 图像分析, 信息检索, 生物信息学...

Python开发:MeetUp API和JSON数据

半瓶木阅读(1443)评论(0)赞(0)

MeetUp是一个社交媒体网站, 允许成员形成虚拟社区, 这些社区在其本地地理区域内组织活动。 MeetUp的概念并不是什么新鲜事物, 但是UI和UX近年来是最具创新性的。简化组织特定于社区, 每天, 每周, 每月或每两个月开会的活动的任务...

Python IF,ELIF和ELSE语句-srcmini

Python IF,ELIF和ELSE语句

半瓶木阅读(1794)评论(0)赞(0)

本文概述 简单的if语句 一次测试:if-else语句 多种测试:if-elif-else语句 嵌套if语句 用任何语言编写代码时, 你都必须控制程序的流程。通常是在涉及决策的情况下-如果满足条件, 你将要执行特定的代码行, 如果不满足, ...

R中的主成分分析

半瓶木阅读(1698)评论(0)赞(0)

本文概述 PCA简介 一个简单的PCA 绘制PCA 解释结果 ggbiplot的图形参数 自定义ggbiplot 添加新样品 将新样品投影到原始PCA上 包起来 主成分分析(PCA)是一种用于探索性数据分析的有用技术, 可让你更好地可视化包...

用Python预测员工流失-srcmini

用Python预测员工流失

半瓶木阅读(1503)评论(0)赞(0)

本文概述 员工流失分析 探索性分析 聚类分析 建立预测模型 评估模型性能 总结 过去, 大多数人关注”费率”, 例如损耗率和保留率。人力资源经理计算以前的费率, 尝试使用数据仓库工具预测未来的费率。这些比率代表了客户...

机器学习模型中的超参数优化-srcmini

机器学习模型中的超参数优化

半瓶木阅读(1804)评论(0)赞(0)

机器学习涉及预测和分类数据, 为此, 你可以根据数据集采用各种机器学习模型。对机器学习模型进行参数化, 以便可以针对给定问题调整其行为。这些模型可以具有许多参数, 找到参数的最佳组合可以视为搜索问题。但是, 如果你不熟悉应用机器学习, 那么...

Python中使用Dash构建仪表板-srcmini

Python中使用Dash构建仪表板

半瓶木阅读(2007)评论(0)赞(0)

本文概述 认证方式 在Heroku上托管仪表板 Dash是用于构建Web应用程序的Python框架。它建立在Flask, Plotly.js, React和React Js之上。它使你能够使用纯Python构建仪表板。 Dash是开源的, ...