Advertisement

Hadoop 开发协同过滤算法(1)

阅读量:

近期持续深入研读《Mahout in Action》一书,直至今日方才完成第一部分的阅读。在第六章中,书中提供了一个关于协同过滤推荐系统的实例,不过该示例所处理的数据类型为布尔值。在Mahout的安装目录中同样提供了该算法的完整源代码,但由于源码本身的复杂性,理解起来较为困难,因此借鉴了书中的示例进行编写(书中示例逻辑清晰,便于理解),并且不仅限于布尔值输入数据的实现;

接下来将对整体思路及具体代码进行详细阐述:

输入数据:

复制代码
    IDID
复制代码
 1,101,5.0

    
 1,102,3.0 
    
 1,103,2.5 
    
 2,101,2.0 
    
 2,102,2.5 
    
 2,103,5.0 
    
 2,104,2.0 
    
 3,101,2.5 
    
 3,104,4.0 
    
 3,105,4.5 
    
 3,107,5.0 
    
 4,101,5.0 
    
 4,103,3.0 
    
 4,104,4.5 
    
 4,106,4.0 
    
 5,101,4.0 
    
 5,102,3.0 
    
 5,103,2.0 
    
 5,104,4.0 
    
 5,105,3.5 
    
 5,106,4.0 
    

全部评论 (0)

还没有任何评论哟~