机器学习weka，java api调用随机森林及保存模型

内容简介：版权声明：本文为博主原创文章，未经博主允许不得转载商用。 https://blog.csdn.net/andy_5826_liu/article/details/84075473

工作需要，了解了一下weka的java api，主要是随机森林这一块，刚开始学习，记录下。

了解不多，直接上demo，里面有一些注释说明：

package weka;

import java.io.File;

import weka.classifiers.Classifier;
import weka.classifiers.trees.RandomForest;
import weka.core.Instances;
import weka.core.SerializationHelper;
import weka.core.converters.ArffLoader;

public class demo {

	public static void main(String[] args) throws Exception {
        
		Classifier m_classifier = new RandomForest();  
        File inputFile = new File("F:/java/weka/trainData.arff");//训练语料文件  
        ArffLoader atf = new ArffLoader();   
        atf.setFile(inputFile);  
        Instances instancesTrain = atf.getDataSet(); // 读入训练文件      
        inputFile = new File("F:/java/weka/testData.arff");//测试语料文件  
        atf.setFile(inputFile);            
        Instances instancesTest = atf.getDataSet(); // 读入测试文件  
        instancesTest.setClassIndex(0); //设置分类属性所在行号（第一行为0号），instancesTest.numAttributes()可以取得属性总数  
        double sum = instancesTest.numInstances(),//测试语料实例数  
        right = 0.0f;  
        instancesTrain.setClassIndex(0);  
        m_classifier.buildClassifier(instancesTrain); //训练
        System.out.println(m_classifier);
        
        // 保存模型
        SerializationHelper.write("LibSVM.model", m_classifier);//参数一为模型保存文件，classifier4为要保存的模型
        
        for(int  i = 0;i<sum;i++)//测试分类结果  1
        {  
            if(m_classifier.classifyInstance(instancesTest.instance(i))==instancesTest.instance(i).classValue())//如果预测值和答案值相等（测试语料中的分类列提供的须为正确答案，结果才有意义）  
            {  
            	right++;//正确值加1  
            }  
        } 
        
        // 获取上面保存的模型
        Classifier classifier8 = (Classifier) weka.core.SerializationHelper.read("LibSVM.model"); 
        double right2 = 0.0f;  
        for(int  i = 0;i<sum;i++)//测试分类结果  2 (通过)
        {  
            if(classifier8.classifyInstance(instancesTest.instance(i))==instancesTest.instance(i).classValue())//如果预测值和答案值相等（测试语料中的分类列提供的须为正确答案，结果才有意义）  
            {  
            	right2++;//正确值加1  
            }  
        } 
        System.out.println(right);
        System.out.println(right2);
        System.out.println(sum);
        System.out.println("RandomForest classification precision:"+(right/sum));  
	}
}

原文：简书ThinkinLiu 博客: IT老五

其中包含了随机森林的使用，包括训练、模型保存及算法结果。实际使用时拆分为两部分，在后台进行训练，客户端使用训练后的模型计算结果。当然还有实时训练的情况，这个后面再去了解。

随机森林可能还有很多配置参数需要调整，后续慢慢去学习。

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持码农网

查看所有标签

本站部分资源来源于网络，本站转载出于传递更多信息之目的，版权归原作者或者来源机构所有，如转载稿涉及版权问题，请联系我们。

码农书籍

Java性能权威指南

奥克斯 (Scott Oaks) / 柳飞、陆明刚、臧秀涛 / 人民邮电出版社 / 2016-3-1 / CNY 79.00

市面上介绍Java的书有很多，但专注于Java性能的并不多，能游刃有余地展示Java性能优化难点的更是凤毛麟角，本书即是其中之一。通过使用JVM和Java平台，以及Java语言和应用程序接口，本书详尽讲解了Java性能调优的相关知识，帮助读者深入理解Java平台性能的各个方面，最终使程序如虎添翼。通过阅读本书，你可以：运用四个基本原则最大程度地提升性能测试的效果使用JDK中......一起来看看《Java性能权威指南》这本书的介绍吧!

码农工具

RGB转16进制工具

RGB HEX 互转工具

图片转BASE64编码

在线图片转Base64编码工具