个性化阅读
专注于IT技术分析

人工智能 第23页

使用Python和BeautifulSoup 4抓取Reddit

半瓶木阅读(2974)评论(0)赞(0)

本文概述 什么是网络爬虫? 先决条件 第一步 获取页面 寻找我们的标签 查找我们的信息 提取我们的信息 将结果写入CSV 移至下一页 负责任地刮 接下来是什么? 相关课程 你可以找到我们将在此处编写的脚本的完整示例。 什么是网络爬虫? 对,...

R中的双变量分布热图

半瓶木阅读(2218)评论(0)赞(0)

本文概述 教程目标 自行车共享数据集 功能选择 直方图 将双变量分布拟合到你的数据 热图 总结 作为数据科学家, 你将必须分析数据集中要素的分布。通常, 这是通过使用直方图完成的, 这对于显示值的可变范围, 其偏差以及值集中的位置非常有用。...

使用Scikit学习进行KNN分类-srcmini

使用Scikit学习进行KNN分类

半瓶木阅读(1553)评论(0)赞(0)

本文概述 K最近邻 KNN算法如何工作? 渴望与懒惰的学习者 维度诅咒 你如何确定KNN中的邻数量? Scikit-learn中的分类器构建 优点 缺点 如何改善KNN? 总结 K最近邻(K Nearest Neighbor, KNN)是一...

制作CSV格式数据集:图像数据集-srcmini

制作CSV格式数据集:图像数据集

半瓶木阅读(3261)评论(0)赞(1)

在机器学习, 深度学习, 数据科学中, 最常用的数据文件是json或CSV, 这里我们将学习CSV并将其用作数据集。 CSV代表逗号分隔值。这些数据库字段已导出为包含一行的格式, 其中用逗号分隔每个数据库记录。扩展名为.csv的文件与纯文本...

DBSCAN:Python的宏观调查-srcmini

DBSCAN:Python的宏观调查

半瓶木阅读(1200)评论(0)赞(0)

简而言之, 群集是将一组对象组合在一起的任务, 以使同一群集中的对象彼此之间的相似性高于其他群集中的对象。相似度是反映两个数据对象之间关系强度的量。聚类主要用于探索性数据挖掘。群集在机器学习, 模式识别, 图像分析, 信息检索, 生物信息学...

Python开发:MeetUp API和JSON数据

半瓶木阅读(1443)评论(0)赞(0)

MeetUp是一个社交媒体网站, 允许成员形成虚拟社区, 这些社区在其本地地理区域内组织活动。 MeetUp的概念并不是什么新鲜事物, 但是UI和UX近年来是最具创新性的。简化组织特定于社区, 每天, 每周, 每月或每两个月开会的活动的任务...

Python IF,ELIF和ELSE语句-srcmini

Python IF,ELIF和ELSE语句

半瓶木阅读(1793)评论(0)赞(0)

本文概述 简单的if语句 一次测试:if-else语句 多种测试:if-elif-else语句 嵌套if语句 用任何语言编写代码时, 你都必须控制程序的流程。通常是在涉及决策的情况下-如果满足条件, 你将要执行特定的代码行, 如果不满足, ...

R中的主成分分析

半瓶木阅读(1697)评论(0)赞(0)

本文概述 PCA简介 一个简单的PCA 绘制PCA 解释结果 ggbiplot的图形参数 自定义ggbiplot 添加新样品 将新样品投影到原始PCA上 包起来 主成分分析(PCA)是一种用于探索性数据分析的有用技术, 可让你更好地可视化包...

用Python预测员工流失-srcmini

用Python预测员工流失

半瓶木阅读(1502)评论(0)赞(0)

本文概述 员工流失分析 探索性分析 聚类分析 建立预测模型 评估模型性能 总结 过去, 大多数人关注”费率”, 例如损耗率和保留率。人力资源经理计算以前的费率, 尝试使用数据仓库工具预测未来的费率。这些比率代表了客户...

机器学习模型中的超参数优化-srcmini

机器学习模型中的超参数优化

半瓶木阅读(1803)评论(0)赞(0)

机器学习涉及预测和分类数据, 为此, 你可以根据数据集采用各种机器学习模型。对机器学习模型进行参数化, 以便可以针对给定问题调整其行为。这些模型可以具有许多参数, 找到参数的最佳组合可以视为搜索问题。但是, 如果你不熟悉应用机器学习, 那么...