万象素材 › 万象专栏 › 人工智能专栏

机器学习07--无监督学习-K-means算法【图文】

无监督学习包含算法

聚类
- K-means(K均值聚类)
降维
- PCA

K-means原理

K-means的聚类效果图

机器学习07--无监督学习-K-means算法_机器学习

K-means聚类步骤

随机设置K个特征空间内的点作为初始的聚类中心
对于其他每个点计算到K个中心的距离，未知的点选择最近的一个聚类中心点作为标记类别
接着对着标记的聚类中心之后，重新计算出每个聚类的新中心点（平均值）
如果计算得出的新中心点与原中心点一样，那么结束，否则重新进行第二步过程

机器学习07--无监督学习-K-means算法_机器学习_02

K-meansAPI

sklearn.cluster.KMeans(n_clusters=8,init=‘k-means++’)

k-means聚类
n_clusters:开始的聚类中心数量
init:初始化方法，默认为'k-means ++’
labels_:默认标记的类型，可以和真实值比较（不是值比较）

案例：k-means对Instacart Market用户聚类

import pandas as pd
from sklearn.decomposition import PCA
from sklearn.cluster import KMeans

# 1、获取数据集
# ·商品信息- products.csv：
# Fields：product_id, product_name, aisle_id, department_id
# ·订单与商品信息- order_products__prior.csv：
# Fields：order_id, product_id, add_to_cart_order, reordered
# ·用户的订单信息- orders.csv：
# Fields：order_id, user_id,eval_set, order_number,order_dow, order_hour_of_day, days_since_prior_order
# ·商品所属具体物品类别- aisles.csv：
# Fields：aisle_id, aisle
products = pd.read_csv("../dataset/products.csv")
order_products = pd.read_csv("../dataset/order_products__prior.csv")
orders = pd.read_csv("../dataset/orders.csv")
aisles = pd.read_csv("../dataset/aisles.csv")

# 2、合并表，将user_id和aisle放在一张表上
# 1）合并orders和order_products on=order_id tab1:order_id, product_id, user_id
tab1 = pd.merge(orders, order_products, on=["order_id", "order_id"])
# 2）合并tab1和products on=product_id tab2:aisle_id
tab2 = pd.merge(tab1, products, on=["product_id", "product_id"])
# 3）合并tab2和aisles on=aisle_id tab3:user_id, aisle
tab3 = pd.merge(tab2, aisles, on=["aisle_id", "aisle_id"])

# 3、交叉表处理，把user_id和aisle进行分组
table = pd.crosstab(tab3["user_id"], tab3["aisle"])

# 4、主成分分析的方法进行降维
# 1）实例化一个转换器类PCA
transfer = PCA(n_components=0.95)
# 2）fit_transform
data = transfer.fit_transform(table)
data_new = data[:500]
km = KMeans(n_clusters=3)
km.fit(data_new)
y_predict = km.predict(data_new)
print(y_predict)

更多文章请关注《万象专栏》

转载请注明出处：https://www.wanxiangsucai.com/read/cv12719

话题推荐： #机器学习# #机器人开发# #人工智能# #万象人工智能专栏#

打赏
4 赞
收藏
评论
举报

下一篇：四个月内掌握AI快速入门人工智能的关键技能与学习路径

发布评论

全部评论(0)

机器学习07--无监督学习-K-means算法【图文】

机器学习07--无监督学习-K-means算法【图文】

无监督学习包含算法

K-means聚类步骤

K-meansAPI

案例：k-means对Instacart Market用户聚类

相关文章

自学UI设计有哪些资料和书籍推荐?【图文】

centos关机后启动区块链浏览器【附源码】

铸造涂料捏合机【图文】

为什么学完Web前端后薪资如此之高？原因如下【图文】

#yyds干货盘点#利用Matplotlib库画图（六）【图文】

蓝牙核心规范（V5.3）-深入详解之SCO和eSCO的异同【图文】

dhcp

以太坊 solidity在线实时编译器【附源码】

fabric docker配置文件---启用ca 选择couchdb数据库【附源码】

MT61K256M32JE-19G:T/D8BWW显卡芯片【图文】