Kylin:来自eBay的开源分布式分析工具;
PivotalR:Pivotal HD / HAWQ和PostgreSQL中的R; Qubole:为自动缩放Hadoop集群,内置的数据连接器; Sense:用于数据科学和大数据分析的云平台;
SnappyData:用于实时运营分析的分布式内存数据存储,提供建立在Spark单一集成集群中的数据流分析、OLTP(联机事务处理)和OLAP(联机分析处理);
Snowplow:企业级网络和事件分析,由Hadoop、Kinesis、Redshift 和Postgres提供技术支持;
SparkR:Spark的R前端;
Splunk:用于机器生成的数据的分析;
Sumo Logic:基于云的分析仪,用于分析机器生成的数据;
Talend:用于YARN、Hadoop、HBASE、Hive、HCatalog和Pig的统一开源环境; Warp:利用大数据(OS X app)的实例查询工具。
搜索引擎与框架
Apache Lucene:搜索引擎库;
Apache Solr:用于Apache Lucene的搜索平台; ElasticSearch:基于Apache Lucene的搜索和分析引擎;
Enigma.io:为免费增值的健壮性web应用,用于探索、筛选、分析、搜索和导出来自网络的大规模数据集;
Facebook Unicorn:社交图形搜索平台; Google Caffeine:连续索引系统; Google Percolator:连续索引系统;
TeraGoogle:大型搜索索引;
HBase Coprocessor:为Percolator的实现,HBase的一部分; Lily HBase Indexer:快速、轻松地搜索存储在HBase的任何内容;
LinkedIn Bobo:完全由Java编写的分面搜索的实现,为Apache Lucene的延伸; LinkedIn Cleo:为一个一个灵活的软件库,使得局部、无序、实时预输入的搜索实现了快速发展;
LinkedIn Galene:LinkedIn搜索架构;
LinkedIn Zoie:是用Java编写的实时搜索/索引系统; Sphinx Search Server:全文搜索引擎
MySQL的分支和演化
Amazon RDS:亚马逊云的MySQL数据库; Drizzle:MySQL的6.0的演化;
Google Cloud SQL:谷歌云的MySQL数据库; MariaDB:MySQL的增强版嵌入式替代品;
MySQL Cluster:使用NDB集群存储引擎的MySQL实现; Percona Server:MySQL的增强版嵌入式替代品; ProxySQL:MySQL的高性能代理;
TokuDB:用于MySQL和 MariaDB的存储引擎;
WebScaleSQL:运行MySQL时面临类似挑战的几家公司,它们的工程师之间的合作。
PostgreSQL的分支和演化
Yahoo Everest – multi-peta-byte database / MPP derived by PostgreSQL. HadoopDB:MapReduce和DBMS的混合体;
IBM Netezza:高性能数据仓库设备;
Postgres-XL:基于PostgreSQL,可扩展的开源数据库集群; RecDB:完全建立在PostgreSQL内部的开源推荐引擎;
Stado:开源MPP数据库系统,只针对数据仓库和数据集市的应用程序; Yahoo Everest:PostgreSQL可以推导多字节P比特数据库/MPP。
Memcached的分支和演化
Facebook McDipper:闪存的键/值缓存; Facebook Memcached:Memcache的分支;
Twemproxy:Memcached和Redis的快速、轻型代理; Twitter Fatcache:闪存的键/值缓存; Twitter Twemcache:Memcache的分支。
嵌入式数据库
Actian PSQL:Pervasive Software公司开发的ACID兼容的DBMS,在应用程序中嵌入了优化;
BerkeleyDB:为键/值数据提供一个高性能的嵌入式数据库的一个软件库; HanoiDB:Erlang LSM BTree存储;
LevelDB:谷歌写的一个快速键-值存储库,它提供了从字符串键到字符串值的有序映射; LMDB:Symas开发的超快、超紧凑的键-值嵌入的式数据存储; RocksDB:基于性LevelDB,用于快速存储的嵌入式持续性键-值存储。
商业智能
BIME Analytics:商业智能云平台;
Chartio:精益业务智能平台,用于可视化和探索数据;
datapine:基于云的自助服务商业智能工具; Jaspersoft:功能强大的商业智能套件; Jedox Palo:定制的商业智能平台; Microsoft:商业智能软件和平台;
Microstrategy:商业智能、移动智能和网络应用软件平台; Pentaho:商业智能平台; Qlik:商业智能和分析平台; Saiku:开源的分析平台; SpagoBI:开源商业智能平台; Tableau:商业智能平台; Zoomdata:大数据分析; Jethrodata:交互式大数据分析。
数据可视化
Airpal:用于PrestoDB的网页UI;
Arbor:利用网络工作者和jQuery的图形可视化库;
Banana:对存储在Kibana中Solr. Port的日志和时戳数据进行可视化;
Bokeh:一个功能强大的Python交互式可视化库,它针对要展示的现代web浏览器,旨在为D3.js风格的新奇的图形提供优雅简洁的设计,同时在大规模数据或流数据集中,通过高性能交互性来表达这种能力; C3:基于D3可重复使用的图表库;
CartoDB:开源或免费增值的虚拟主机,用于带有强大的前端编辑功能和API的地理空间数据库;
chartd:只带Img标签的反应灵敏、兼容Retina的图表; Chart.js:开源的HTML5图表可视化效果; Chartist.js:另一个开源HTML5图表可视化效果;
Crossfilter:JavaScript库,用于在浏览器中探索多元大数据集,用Dc.js和D3.js.效果很好;
Cubism:用于时间序列可视化的JavaScript库; Cytoscape:用于可视化复杂网络的JavaScript库;
DC.js:维度图表,和Crossfilter一起使用,通过D3.js呈现出来,它比较擅长连接图表/附加的元数据,从而徘徊在D3的事件附近; D3:操作文件的JavaScript库;
D3.compose:从可重复使用的图表和组件构成复杂的、数据驱动的可视化; D3Plus:一组相当强大的可重用的图表,还有D3.js的样式; Echarts:百度企业场景图表; Envisionjs:动态HTML5可视化;
FnordMetric:写SQL查询,返回SVG图表,而不是表; Freeboard:针对IOT和其他Web混搭的开源实时仪表盘构建;
Gephi:屡获殊荣的开源平台,可视化和操纵大型图形和网络连接,有点像Photoshop,但是针对于图表,适用于Windows和Mac OS X; Google Charts:简单的图表API;
Grafana:石墨仪表板前端、编辑器和图形组合器; Graphite:可扩展的实时图表; Highcharts:简单而灵活的图表API;