当前位置：首页 > 软件库 > 企业应用 > BI商业智能 >

Weka

数据挖掘工作平台

授权协议 GPL

开发语言 Java

所属分类企业应用、 BI商业智能

软件类型开源软件

地区不详

投递者夏侯朝斑

操作系统跨平台

开源组织无

适用人群未知

软件概览

WEKA的全名是怀卡托智能分析环境（Waikato Environment for Knowledge Analysis），同时weka也是新西兰的一种鸟名，而WEKA的主要开发者来自新西兰。

WEKA作为一个公开的数据挖掘工作平台，集合了大量能承担数据挖掘任务的机器学习算法，包括对数据进行预处理，分类，回归、聚类、关联规则以及在新的交互式界面上的可视化。

如果想自己实现数据挖掘算法的话，可以看一看weka的接口文档。在weka中集成自己的算法甚至借鉴它的方法自己实现可视化工具并不是件很困难的事情。

2005年8月，在第11届ACM SIGKDD国际会议上，怀卡托大学的Weka小组荣获了数据挖掘和知识探索领域的最高服务奖，Weka系统得到了广泛的认可，被誉为数据挖掘和机器学习历史上的里程碑，是现今最完备的数据挖掘工具之一（已有11年的发展历史）。Weka的每月下载次数已超过万次。

相关资料

数据挖掘算法

数据挖掘 18 大算法实现以及其他相关经典 DM 算法，BIRCH 算法本身上属于一种聚类算法，不过他克服了一些 K-Means 算法的缺点。
数据挖掘九律

一位挖掘专家 tom khabaza 提出了挖掘九律，挺好的东西，特别是九这个数字，深得中华文化精髓，有点独孤九剑的意思：第一，目标律。数据挖掘是一个业务过程，必须得有业务目标。无目的，无过程。第二，知识律。业务知识贯穿在挖掘这个业务过程的各环节。第三，准备律。数据获取、数据准备等数据处理耗时占整个挖掘过程的一半。第四，NFL律。 NFL，没有免费的午餐。没有一个固定的算法适用所有的
数据挖掘面经记录

字节跳动 (1h) 1.自我面试 2.挑一个你认为比较成功的项目进行介绍？ 3.介绍你做过的特征工程 4.你都有过哪些算法？介绍下随机森林、XGB、GBDT的差异 5.对模型进行评估时候选取的方法携程控股(45min) 1.自我介绍 2.选择一个项目进行介绍 3.你建模的时候都用到哪些方法 4.项目细节 5.模型评估腾讯科技(1个小时) 1.自我介绍 2.直接问项目 3.解释下随机森林和GBD
大华数据挖掘面经

硕士研究cv 可能和数据挖掘不是那么匹配~ 大华一面（1h）： 1、增量学习的科研项目（问了具体的细节以及为什么） 2、语义分割的发展 3、UNet中的跳跃连接的作用 4、残差网络的shortcut连接的作用，数学方面证明残差网络可以避免梯度消失，并且问了一个关于残差网络的改进问题（面试官看最新的论文看到的，我没有理解他所说的问题） 5、宫颈肿瘤分割和pcr预测的项目（细节也问的很详细） 6、预
数据挖掘十大算法

数据挖掘通常与计算机科学有关，并通过统计、在线分析处理、情报检索、机器学习、专家系统（依靠过去的经验法则）和模式识别等诸多方法来实现上述目标。
常用数据挖掘算法

1.1 KNN 1.1.1 思想计算离待分类点距离最近的 K 个已分类点，K 个点中出现最多点种类为待分类点的种类。 1.1.2 距离常见距离有欧式距离和余弦距离。余弦距离可以消除量纲的影响。相关系数 2. 聚类算法 2.1 K-means 2.1.1 思想 2.1.1.1 模型训练根据类别个数 N，初始化 N 个点，作为该类别的中点。遍历其他点，计算距离最近的中心点，该中心点的类别为当前
雷火数据挖掘-笔试

2道编程共40分，5道问答110分，共两个半小时，没做多久就退出来，哎。。。有一道编程题用例过了，一提交通过0个用例，麻了大佬给看看：题目是车牌号识别准确率计算输入N个车牌号，第一个字母是颜色，最后5个是号码，中间是地区号每一行一个识别出的号码，一个真实标签 #我的秋招日记##网易雷火笔试##23届秋招笔面经#
联想数据挖掘凉经

时间过去有点久了，纯凭回忆，可能有些遗漏一面（1小时多吧）机器学习基础知识 Bagging & Boosting 常用的聚类算法 Kmeans和DBSCAN的原理和区别逻辑回归的原理怎么处理离散数据支持向量机原理 SVM怎么处理非线性常用的回归模型 Attention原理 RNN和LSTM的区别什么是梯度爆炸/梯度消失，什么情况下会出现梯度渐进的原理手撕算法判断是否是回文找

同类工具

FreeAnalysis OLAP4J LucidDB BIPLAM Pivot4J Palo ETL Server Bizgres Saiku

相关阅读

Web挖掘还是抓取或抓取？我应该使用什么工具/库？数据框到Excel工作表微信公众平台开发数据库操作数据库索引如何工作？使用WEKA API定义输入数据以进行聚类

相关文章

蓝月亮(数据挖掘)凉经 CVTE电话面试–数据挖掘 CVTE数据挖掘方向面经联想数据挖掘一面+二面信也科技数据挖掘一面

相关问答

深入挖掘python if语句[重复]数据挖掘 - 58同城url无规律变化，是一种反爬措施吗？以太坊私有区块链空区块挖掘为什么我会得到SOA挖掘的响应？用于文本挖掘或聊天机器人的NLP

相关文档

数据挖掘算法数据挖掘十大算法面向程序员的数据挖掘指南 WEKA 3.5.5 用户指南百度站长平台工具使用手册