大数据资源整理(4)

2019-08-26 17:48

Kylin:来自eBay的开源分布式分析工具;

PivotalR:Pivotal HD / HAWQ和PostgreSQL中的R; Qubole:为自动缩放Hadoop集群,内置的数据连接器; Sense:用于数据科学和大数据分析的云平台;

SnappyData:用于实时运营分析的分布式内存数据存储,提供建立在Spark单一集成集群中的数据流分析、OLTP(联机事务处理)和OLAP(联机分析处理);

Snowplow:企业级网络和事件分析,由Hadoop、Kinesis、Redshift 和Postgres提供技术支持;

SparkR:Spark的R前端;

Splunk:用于机器生成的数据的分析;

Sumo Logic:基于云的分析仪,用于分析机器生成的数据;

Talend:用于YARN、Hadoop、HBASE、Hive、HCatalog和Pig的统一开源环境; Warp:利用大数据(OS X app)的实例查询工具。

搜索引擎与框架

Apache Lucene:搜索引擎库;

Apache Solr:用于Apache Lucene的搜索平台; ElasticSearch:基于Apache Lucene的搜索和分析引擎;

Enigma.io:为免费增值的健壮性web应用,用于探索、筛选、分析、搜索和导出来自网络的大规模数据集;

Facebook Unicorn:社交图形搜索平台; Google Caffeine:连续索引系统; Google Percolator:连续索引系统;

TeraGoogle:大型搜索索引;

HBase Coprocessor:为Percolator的实现,HBase的一部分; Lily HBase Indexer:快速、轻松地搜索存储在HBase的任何内容;

LinkedIn Bobo:完全由Java编写的分面搜索的实现,为Apache Lucene的延伸; LinkedIn Cleo:为一个一个灵活的软件库,使得局部、无序、实时预输入的搜索实现了快速发展;

LinkedIn Galene:LinkedIn搜索架构;

LinkedIn Zoie:是用Java编写的实时搜索/索引系统; Sphinx Search Server:全文搜索引擎

MySQL的分支和演化

Amazon RDS:亚马逊云的MySQL数据库; Drizzle:MySQL的6.0的演化;

Google Cloud SQL:谷歌云的MySQL数据库; MariaDB:MySQL的增强版嵌入式替代品;

MySQL Cluster:使用NDB集群存储引擎的MySQL实现; Percona Server:MySQL的增强版嵌入式替代品; ProxySQL:MySQL的高性能代理;

TokuDB:用于MySQL和 MariaDB的存储引擎;

WebScaleSQL:运行MySQL时面临类似挑战的几家公司,它们的工程师之间的合作。

PostgreSQL的分支和演化

Yahoo Everest – multi-peta-byte database / MPP derived by PostgreSQL. HadoopDB:MapReduce和DBMS的混合体;

IBM Netezza:高性能数据仓库设备;

Postgres-XL:基于PostgreSQL,可扩展的开源数据库集群; RecDB:完全建立在PostgreSQL内部的开源推荐引擎;

Stado:开源MPP数据库系统,只针对数据仓库和数据集市的应用程序; Yahoo Everest:PostgreSQL可以推导多字节P比特数据库/MPP。

Memcached的分支和演化

Facebook McDipper:闪存的键/值缓存; Facebook Memcached:Memcache的分支;

Twemproxy:Memcached和Redis的快速、轻型代理; Twitter Fatcache:闪存的键/值缓存; Twitter Twemcache:Memcache的分支。

嵌入式数据库

Actian PSQL:Pervasive Software公司开发的ACID兼容的DBMS,在应用程序中嵌入了优化;

BerkeleyDB:为键/值数据提供一个高性能的嵌入式数据库的一个软件库; HanoiDB:Erlang LSM BTree存储;

LevelDB:谷歌写的一个快速键-值存储库,它提供了从字符串键到字符串值的有序映射; LMDB:Symas开发的超快、超紧凑的键-值嵌入的式数据存储; RocksDB:基于性LevelDB,用于快速存储的嵌入式持续性键-值存储。

商业智能

BIME Analytics:商业智能云平台;

Chartio:精益业务智能平台,用于可视化和探索数据;

datapine:基于云的自助服务商业智能工具; Jaspersoft:功能强大的商业智能套件; Jedox Palo:定制的商业智能平台; Microsoft:商业智能软件和平台;

Microstrategy:商业智能、移动智能和网络应用软件平台; Pentaho:商业智能平台; Qlik:商业智能和分析平台; Saiku:开源的分析平台; SpagoBI:开源商业智能平台; Tableau:商业智能平台; Zoomdata:大数据分析; Jethrodata:交互式大数据分析。

数据可视化

Airpal:用于PrestoDB的网页UI;

Arbor:利用网络工作者和jQuery的图形可视化库;

Banana:对存储在Kibana中Solr. Port的日志和时戳数据进行可视化;

Bokeh:一个功能强大的Python交互式可视化库,它针对要展示的现代web浏览器,旨在为D3.js风格的新奇的图形提供优雅简洁的设计,同时在大规模数据或流数据集中,通过高性能交互性来表达这种能力; C3:基于D3可重复使用的图表库;

CartoDB:开源或免费增值的虚拟主机,用于带有强大的前端编辑功能和API的地理空间数据库;

chartd:只带Img标签的反应灵敏、兼容Retina的图表; Chart.js:开源的HTML5图表可视化效果; Chartist.js:另一个开源HTML5图表可视化效果;

Crossfilter:JavaScript库,用于在浏览器中探索多元大数据集,用Dc.js和D3.js.效果很好;

Cubism:用于时间序列可视化的JavaScript库; Cytoscape:用于可视化复杂网络的JavaScript库;

DC.js:维度图表,和Crossfilter一起使用,通过D3.js呈现出来,它比较擅长连接图表/附加的元数据,从而徘徊在D3的事件附近; D3:操作文件的JavaScript库;

D3.compose:从可重复使用的图表和组件构成复杂的、数据驱动的可视化; D3Plus:一组相当强大的可重用的图表,还有D3.js的样式; Echarts:百度企业场景图表; Envisionjs:动态HTML5可视化;

FnordMetric:写SQL查询,返回SVG图表,而不是表; Freeboard:针对IOT和其他Web混搭的开源实时仪表盘构建;

Gephi:屡获殊荣的开源平台,可视化和操纵大型图形和网络连接,有点像Photoshop,但是针对于图表,适用于Windows和Mac OS X; Google Charts:简单的图表API;

Grafana:石墨仪表板前端、编辑器和图形组合器; Graphite:可扩展的实时图表; Highcharts:简单而灵活的图表API;


大数据资源整理(4).doc 将本文的Word文档下载到电脑 下载失败或者文档不完整,请联系客服人员解决!

下一篇:幼儿园课程模拟卷D

相关阅读
本类排行
× 注册会员免费下载(下载后可以自由复制和排版)

马上注册会员

注:下载文档有可能“只有目录或者内容不全”等情况,请下载之前注意辨别,如果您已付费且无法下载或内容有问题,请联系我们协助你处理。
微信: QQ: