- 微信
- 微博
  
  分享文章到微博
- 复制链接
  
  复制链接到剪贴板

机器学习之使用聚类算法对图像进行压缩

南蓬幽发表于 2022/05/29 11:40:11 2022/05/29

【摘要】聚类算法案例聚类算法聚类算法（Clustering），是对大量未知标注的数据集，按数据的内在相似性，将数据集划分为多个互不相交的子集，每个子集称为一个簇，使簇内数据的相似度较大而簇间数据的相似度较小。聚类算法属于无监督机器学习，只有数据x，没有标签y。常见的聚类算法：k-Means、 spectral clustering、mean-shift等。from sklearn.cluster...

聚类算法案例

聚类算法

聚类算法（Clustering），是对大量未知标注的数据集，按数据的内
在相似性，将数据集划分为多个互不相交的子集，每个子集称为一个簇，
使簇内数据的相似度较大而簇间数据的相似度较小。
聚类算法属于无监督机器学习，只有数据x，没有标签y。
常见的聚类算法：k-Means、 spectral clustering、mean-shift等。

from sklearn.cluster import KMeans,MiniBatchKMeans
from sklearn.datasets import make_blobs
import matplotlib.pyplot as plt
from sklearn.metrics import silhouette_score,calinski_harabasz_score,davies_bouldin_score

X,_ = make_blobs(n_samples=1000)
plt.scatter(X[:,0],X[:,1],marker='o')
plt.show()
km = KMeans(n_clusters=3)
km.fit(X)

x_pred = km.predict(X)
plt.scatter(X[:,0],X[:,1],c=x_pred)
plt.show()

si = silhouette_score(X,km.predict(X))
ca = calinski_harabasz_score(X,km.predict(X))
dv = davies_bouldin_score(X,km.predict(X))

print("轮廓系数为：",si)
print("calinski_harabasz_score为：",ca)
print('davies_bouldin_score为：',dv)

使用聚类算法对图像进行压缩
其核心思想是：通过聚类将颜色表示数量减少。
RGB图像，3个通道，每个通道用8位表示，通过聚类，选取颜色空间
中的n个聚类，将图片上的每种颜色分配到一个类别，那么表示一种颜色
只需要log 2 n位，对图片进行了压缩。

图片压缩

import cv2
from sklearn.cluster import KMeans
import numpy as np

img = cv2.imread('lena.png')  # w,h ,c
img_data = img.reshape(-1,3)

kmeans = KMeans(n_clusters=16)
kmeans.fit(img_data)

new_img = kmeans.cluster_centers_[kmeans.labels_]
print(new_img.dtype)
new_img = new_img.astype(np.uint8)
new_img = new_img.reshape(img.shape)

cv2.imwrite('new_img1.png',new_img)

压缩后的图片

点赞
收藏
关注作者

0/1000

抱歉，系统识别当前为高风险访问，暂不支持该操作

全部回复

上滑加载中

设置昵称

在此一键设置昵称，即可参与社区互动！

*长度不超过10个汉字或20个英文字符，设置后3个月内不可修改。

确认取消

加入云驻计划，成为创作者

华为云周边好礼
免费体验产品
特殊身份标识
线下官方门票
内部专家零距离
与10000+优质创作者共同成长

立即加入

机器学习之使用聚类算法对图像进行压缩

聚类算法案例

聚类算法

图片压缩

压缩后的图片

全部回复

设置昵称

关于作者

目录

加入云驻计划，成为创作者

机器学习之使用聚类算法对图像进行压缩

聚类算法案例

聚类算法

图片压缩

压缩后的图片

全部回复

设置昵称

关于作者

目录

加入云驻计划，成为创作者

推荐阅读

相关产品