python协同过滤算法实现电影推荐（附源码）

pandas 算法 python 2023-09-06 18:09:40 766人浏览独家记忆

Python 官方文档：入门教程 => 点击学习

摘要

数据集请点赞收藏关注后评论区留言并且私信博主要本例中使用得是著名得电影数据集MovieLens-100数据集 MoviesLens数据集是实现和测试电影推荐最常用得数据集之一，包含943个用户为精选得1682部电影给出得100000个电

数据集请点赞收藏关注后评论区留言并且私信博主要

本例中使用得是著名得电影数据集MovieLens-100数据集

MoviesLens数据集是实现和测试电影推荐最常用得数据集之一，包含943个用户为精选得1682部电影给出得100000个电影评分

主要文件如下1:u.data 2:u.item 3:u.user

1：查看用户/电影排名信息得代码如下

import  pandas as pdheads=['user_id','item_id','rating','timestamp']ratings=pd.read_csv(r'u.data',sep='\t',names=heads)print(ratings)print("用户数量",len(ratings))

2：查看导入的电影数据表

代码如下

import  pandas as pdu_cols=['user_id','age','sex','occupation','zip_code']users=pd.read_csv(r'u.data',sep='|',names=u_cols,encoding='latin-1')print(users)r_cols=['user_id','movie_id','rating','unix_timestamp']ratings=pd.read_csv(r'u.data',sep='\t',names=r_cols,encoding='latin-1')print(ratings)m_cols=['movie_id','title','release_data','video_release_data','imdb_url']movies=pd.read_csv(r'u.item',sep='|',names=m_cols,usecols=range(5),encoding='latin-1')print(movies)

3：用协同过滤推荐算法进行电影推荐

误差评估如下

全部代码如下

import  pandas as pdimport  numpy as npfrom sklearn.metrics.pairwise import pairwise_distancesnp.set_printoptions(suppress=True)  # 取消科学计数法输出pd.set_option('display.max_rows', None) # 展示所有行pd.set_option('display.max_columns', None) # 展示所有列def predict(scoredata,similarity,type='user'):    #基于物品得推荐    if type=='item':        predt_mat=scoredata.dot(similarity)/np.array([np.abs(similarity).sum(axis=1)])    elif type=='user':        #计算用户评分值 减少用户评分高低习惯影响        user_meanscorse=scoredata.mean(axis=1)        score_diff=(scoredata-user_meanscorse.reshape(-1,1))        predt_mat=user_meanscorse.reshape(-1,1)+similarity.dot(score_diff)/np.array([np.abs(similarity).sum(axis=1)]).T    return predt_mat#读取数据print('step 1 读取数据')r_cols=['user_id','movie_id','rating','unix_timestamp']scoredata=pd.read_csv(r'u.data',sep='\t',names=r_cols,encoding='latin-1')print('数据形状',scoredata.shape)#生成用户-物品评分矩阵print('step2 生成 用户物品评分矩阵')n_users=943n_items=1682data_matrix=np.zeros((n_users,n_items))for line in range(np.shape(scoredata)[0]):    row=scoredata['user_id'][line]-1    col=scoredata['movie_id'][line]-1    score=scoredata['rating'][line]    data_matrix[row,col]=scoreprint('用户物品矩阵形状',data_matrix.shape)#计算相似度print('step3 计算相似度')user_similaritry=pairwise_distances(data_matrix,metric='cosine')item_similarity=pairwise_distances(data_matrix.T,metric='cosine')print('user similarity',user_similaritry.shape)print('item similartity',item_similarity.shape)#进行相似度进行预测print('step4 预测')user_prediction=predict(data_matrix,user_similaritry,type='user')item_perdiction=predict(data_matrix,item_similarity,type='item')#显示推荐结果print('step 5 显示推荐结果')print('----------------')print('ubcf预测形状',user_prediction.shape)print('real answer\n',data_matrix[:5,5])print('预测结果\n',user_prediction)print('ibcf预测形状',item_perdiction.shape)print('real answer\n',data_matrix[:5,:5])print('预测结果\n',item_perdiction)#性能评估print('step 6 性能评估')from sklearn.metrics import mean_squared_errorfrom math import sqrtdef rmse(predct,realNum):    predct=predct[realNum.nonzero()].flatten()    realNum=realNum[realNum.nonzero()].flatten()    return sqrt(mean_squared_error(predct,realNum))print('u-base mse=',str(rmse(user_prediction,data_matrix)))print('m-based mse=',str(rmse(item_perdiction,data_matrix)))

数据集请点赞收藏关注后私信博主要

来源地址：https://blog.csdn.net/jiebaoshayebuhui/article/details/126966927

您可能感兴趣的文档:

点击免费下载>>软考高级考试备考技巧/历年真题/备考精华资料

--结束END--

本文标题: python协同过滤算法实现电影推荐（附源码）

本文链接: https://www.lsjlt.com/news/397401.html(转载时请注明来源链接)

有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

本篇文章演示代码以及资料文档资料下载

下载Word文档到电脑，方便收藏和打印～

下载Word文档

去做题

猜你喜欢

python协同过滤算法实现电影推荐（附源码）

数据集请点赞收藏关注后评论区留言并且私信博主要本例中使用得是著名得电影数据集MovieLens-100数据集 MoviesLens数据集是实现和测试电影推荐最常用得数据集之一，包含943个用户为精选得1682部电影给出得100000个电...

99+

2023-09-06

pandas 算法 python
Java如何实现基于用户的协同过滤推荐算法

小编给大家分享一下Java如何实现基于用户的协同过滤推荐算法，希望大家阅读完这篇文章之后都有所收获，下面让我们一起去探讨吧！协同过滤简单来说是利用某兴趣相投、拥有共同经验之群体的喜好来推荐用户感兴趣的信息，个人通过合作的机制给予信息相当程度...

99+

2023-05-30

java
基于Python+协同过滤算法的小说推荐系统设计与实现

博主介绍：✌全网粉丝30W+,csdn特邀作者、博客专家、CSDN新星计划导师、Java领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java技术领域和毕业项目实战✌ 🍅文末获取源码联...

99+

2023-10-23

python 开发语言协同过滤算法小说推荐系统 django 原力计划
（附源码）springboot基于JAVA的电影推荐系统的开发与实现毕业设计112306

目录摘要 4 Abstract 5 第1章前言 6 1.1 研究背景 6 1.2 研究现状 6 1.3 系统开发目标 6 第2章技术与原理 8 2.1 JSP介绍 8 2.2 JAVA技术 8 ...

99+

2023-09-01

spring boot python php android java Powered by 金山文档
springboot基于JAVA的电影推荐系统的开发与实现附源码-毕业设计112306

目录摘要 4 Abstract 5 第1章前言 6 1.1 研究背景 6 ...

99+

2023-09-03

java spring boot python android php
（附源码）python音乐电台推荐系统的设计与实现毕业设计 301210

音乐电台推荐系统摘要随着人类向信息社会的不断迈进，风起云涌的信息时代正掀起一次新的革命，同时计算机网络技术高速发展，网络管理运用也变得越来越广泛。因此，建立一个B/S结构的音乐电台推荐系统来管理音乐电台信息，会使管理工作系统化、规...

99+

2023-08-31

python java spring boot mysql idea
RiSearch PHP 与协同过滤算法结合实现个性化搜索

引言：随着互联网的飞速发展，人们对搜索引擎的需求也日益增长。传统的搜索引擎往往只能根据用户提供的关键词进行搜索，无法真正地根据用户的兴趣和偏好来个性化推荐结果。为了解决这个问题，我们可以将RiSearch PHP与协同过滤算法结合起来，实现...

99+

2023-10-21

个性化搜索 RiSearch PHP 协同过滤算法
python 实现k-means聚类算法银行客户分组画像实战（超详细，附源码）

想要数据集请点赞关注收藏后评论区留言留下QQ邮箱 k-means具体是什么这里就不再赘述，详情可以参见我这篇博客 k-means 问题描述：银行对客户信息进行采集，获得了200位客户的数据，客户特征包括以下四个1：社保号码 2：姓名 ...

99+

2023-09-09

聚类 kmeans 数据挖掘 python 机器学习
ssm咖啡销售系统电脑设计实现 51842 (免费领源码、附论文）可做计算机毕业设计JAVA、PHP、爬虫、APP、小程序、C#、C++、python、数据可视化、大数据、全套文案

摘要科技进步的飞速发展引起人们日常生活的巨大变化，电子信息技术的飞速发展使得电子信息技术的各个领域的应用水平得到普及和应用。信息时代的到来已成为不可阻挡的时尚潮流，人类发展的历史正进入一个新时代。现代社会越来越多的人追求便捷购...

99+

2023-10-26

课程设计 java php 宠物 spring boot 爬虫小程序