9个最佳的大数据处理编程语言 -欧洲杯足彩官网

0顶
0踩

9个最佳的大数据处理编程语言

2017-07-25 15:03 by 副主编 jihong10102006 评论(0) 有10174人浏览
引用
文章来自:

大数据的浪潮仍在继续。它渗透到了几乎所有的行业,信息像洪水一样地席卷企业,使得软件越发庞然大物,比如excel看上去就变得越来越笨拙。数据处理不再无足轻重,并且对精密分析和强大又实时处理的需要变得前所未有的巨大。

那么,在巨大的数据集中进行筛选的最好工具是什么?通过和数据骇客的交流,我们知道了他们用于硬核数据分析最喜欢的语言和工具包。

r语言

在这些语言名单中,如果r语言排第二,那就没其他能排第一。自1997年以来,作为昂贵的统计软件,如matlab和sas的免费替代品,它渐渐风靡全球。

在过去的几年时间中,r语言已经成为了数据科学的宠儿——数据科学现在不仅仅在书呆子一样的统计学家中人尽皆知,而且也为华尔街交易员,生物学家,和硅谷开发者所家喻户晓。各种行业的公司,例如google,facebook,美国银行,以及纽约时报都使用r语言,r语言正在商业用途上持续蔓延和扩散。

r语言有着简单而明显的吸引力。使用r语言,只需要短短的几行代码,你就可以在复杂的数据集中筛选,通过先进的建模函数处理数据,以及创建平整的图形来代表数字。它被比喻为是excel的一个极度活跃版本。

r语言最伟大的资本是已围绕它开发的充满活力的生态系统:r语言社区总是在不断地添加新的软件包和功能到它已经相当丰富的功能集中。据估计,超过200万的人使用r语言,并且最近的一次投票表明,r语言是迄今为止在科学数据中最流行的语言,被61%的受访者使用(其次是python,39%)。

此外,它的身影也渐渐出现在了华尔街。以前,银行分析师会全神贯注于excel文件直到深夜,但现在r语言被越来越多地用于金融建模r,特别是作为一种可视化工具,niall o’connor,美国银行的副总裁如是说。 “r语言使我们平凡的表格与众不同,”他说。

r语言的日渐成熟,使得它成为了数据建模的首选语言,虽然当企业需要生产大型产品时它的能力会变得有限,也有的人说这是因为它的地位正在被其他语言篡夺。

“r更适合于做一个草图和大概,而不是详细的构建,”michael driscoll,metamarkets的首席执行官说。 “你不会在谷歌的网页排名以及facebook的朋友推荐算法的核心找到r语言。工程师会用r语言做原型,然后移交给用java或python写的模型。”

话说回来,早在2010年,paul butler就以r语言打造了全球的facebook地图而著名,这证明了该语言丰富的可视化功能。尽管他现在已经不像以前那样频繁地使用r语言了。

“r正在一点点地过时,因为它的缓慢和处理大型数据集的笨重,”butler说。

那么,他使用什么代替呢?请继续阅往下看。

python

如果说r语言是一个神经质又可爱的高手,那么python是它随和又灵活的表兄弟。作为一种结合了r语言快速对复杂数据进行挖掘的能力并构建产品的更实用语言,python迅速得到了主流的吸引力。python是直观的,并且比r语言更易于学习,以及它的生态系统近年来急剧增长,使得它更能够用于先前为r语言保留的统计分析。

“这是这个行业的进步。在过去的两年时间中,从r语言到python已经发生了非常明显的转变,”butler说。

在数据处理中,在规模和复杂性之间往往会有一个权衡,于是python成为了一种折中方案。ipython notebook和numpy可以用作轻便工作的一种暂存器,而python可以作为中等规模数据处理的强大工具。丰富的数据社区,也是python的优势,因为可以提供了大量的工具包和功能。

美国银行使用python在银行的基础架构中构建新的产品和接口,同时也用python处理财务数据。“python广泛而灵活,因此人们趋之若鹜,”o’donnell说。

不过,它并非最高性能的语言,只能偶尔用于大规模的核心基础设施,driscoll这样说道。

julia

虽然当前的数据科学绝大多数是通过r语言,python,java,matlab和sas执行的。但依然有其他的语言存活于夹缝中,julia就是值得一看的后起之秀。

业界普遍认为julia过于晦涩难懂。但数据骇客在谈到它取代r和python的潜力时会不由得眉飞色舞。julia是一种高层次的,极度快速的表达性语言。它比r语言快,比python更可扩展,且相当简单易学。

“它正在一步步成长。最终,使用julia,你就能够办到任何用r和python可以做到的事情,”butler说。

但是至今为止,年轻人对julia依然犹豫不前。julia数据社区还处于早期阶段,要能够和r语言和python竞争,它还需要添加更多的软件包和工具。

“它还很年轻,但它正在掀起浪潮并且非常有前途,”driscoll说。

java

java,以及基于java的框架,被发现俨然成为了硅谷最大的那些高科技公司的骨骼支架。 “如果你去看twitter,linkedin和facebook,那么你会发现,java是它们所有数据工程基础设施的基础语言,”driscoll说。

java不能提供r和python同样质量的可视化,并且它并非统计建模的最佳选择。但是,如果你移动到过去的原型制作并需要建立大型系统,那么java往往是你的最佳选择。

hadoop和hive

一群基于java的工具被开发出来以满足数据处理的巨大需求。hadoop作为首选的基于java的框架用于批处理数据已经点燃了大家的热情。hadoop比其他一些处理工具慢,但它出奇的准确,因此被广泛用于后端分析。它和hive——一个基于查询并且运行在顶部的框架可以很好地结对工作。

scala

scala是另一种基于java的语言,并且和java相同的是,它正日益成为大规模机器学习,或构建高层次算法的工具。它富有表现力,并且还能够构建健壮的系统。

“java就像是建造时的钢铁,而scala则像黏土,因为你之后可以将之放入窑内转变成钢铁,”driscoll说。

kafka和storm

那么,当你需要快速实时的分析时又该怎么办呢?kafka会成为你的好朋友。它大概5年前就已经出现了,但是直到最近才成为流处理的流行框架。

kafka,诞生于linkedin内部,是一个超快速的查询消息系统。kafka的缺点?好吧,它太快了。在实时操作时会导致自身出错,并且偶尔地会遗漏东西。

“有精度和速度之间有一个权衡,”driscoll说, “因此,硅谷所有的大型高科技公司都会使用两条管道:kafka或storm用于实时处理,然后hadoop用于批处理系统,此时虽然是缓慢的但超级准确。”

storm是用scala编写的另一个框架,它在硅谷中因为流处理而受到了大量的青睐。它被twitter纳入其中,勿庸置疑的,这样一来,twitter就能在快速事件处理中得到巨大的裨益。

鼓励奖:

➤matlab

matlab一直以来长盛不衰,尽管它要价不菲,但它仍然被广泛使用在一些非常特殊的领域:研究密集型机器学习,信号处理,图像识别,仅举几例。

➤octave

octave和matlab非常相似,但它是免费的。不过,它在学术性信号处理圈子之外很少见到。

➤go

go是另一个正在掀起浪潮的后起之秀。它由google开发,从c语言松散地派生,并在构建健壮基础设施上,正在赢得竞争对手,例如java和python的份额。
来自: d1net
0
0
评论 共 0 条 请登录后发表评论

发表评论

您还没有登录,请您登录后再发表评论

相关推荐

  • 以下是总结的十大合适大数据处理的编程语言。1.r语言r语言是数据科学的宠儿,r语言有着简单而明显的吸引力,使用r语言,只需要短短的几行代码,你就可以在复杂的数据集中筛选,通过先进的建模函数处理数据,以及创建...

  • 通过和数据骇客的交流,我们知道了他们用于硬核数据分析最喜欢的语言和工具包。  r语言  在这些语言名单中,如果r语言排第二,那就没其他能排第一。自1997年以来,作为昂贵的统计软件,如matlab和sas的...

  • 之所以说这件事,就是想告诉同学们,努力固然重要,但选择必须要对,一旦选择错了,那很多努力都是白费。这篇文章就是来给同学们提个醒,2022 年最好的编程语言是什么?看完后你就知道该如何地去选择了。 ......

  • 作者:禅与计算机程序设计...在海量的数据面前,如何有效地进行数据采集、存储、清洗是目前研究人员和工程师的共同关注点。而数据中台(data warehouse as a service)是一种云计算服务模型,通过将数据采集、存储、清洗

  • 十大编程语言lots of programming languages to choose from and you don’t know where to start? this listicle is for you! we’re discussing the best programming languages of 2020 today. 许多编程语言可供...

  • 随着大数据的热潮不断升温,几乎各个领域都有洪水倾泻般的信息涌来,面对用户成千上万的浏览记录、记录行为数据,如果就单纯的excel来进行数据处理是远远不能满足的。但如果只用一些操作软件来分析,而不怎么如何用...

  • 先来个简要的概括: java,服务器端最好的编程语言 c ,最通用的编程语言 c,迄今为止,最值得信任的编程语言 python,ai(人工智能)、机器学习方向最佳的编程语言 javascript,客户端最常用的脚本语言 c#,微软...

  • 以下是总结的十大合适大数据处理的编程语言。1. r语言r语言是数据科学的宠儿,r语言有着简单而明显的吸引力,使用r语言,只需要短短的几行代码,你就可以在复杂的数据集中筛选,通过先进的建模函数处理数据,以及...

  • 今天的ai程序员应该掌握多种语言,因为他们在跨学科的环境中工作,而不是在孤岛中工作。 虽然当前这一代人更喜欢python,r,java,lisp,prolog,julia等 ,但前端开发人员必须了解javascript,python和r的机器学习...

  • 译者 | 弯月出品 | csdn(id:csdnnews)以下为译文:如果你是一名新晋的 web 开发人员,那么在选择最佳 web 编程语言时将面临很多困难。不同的编程语言支持不同的编程技...

  • 在大数据分析学习哪些编程语言中,我们将学习一些必需的大数据分析编程语言,以便成为一名熟练的大数据分析家。  大数据分析导论  编程是软件开发的基础。大数据分析是包括计算机科学在内的多个领域的集合。它...

  • 人工智能ai用什么编程语言 ai( 人工智能 )为应用程序开发人员开辟了无限的可能性。 通过利用机器学习或深度学习,您可以产生更好的用户配置文件,个性化设置和推荐,或者合并更智能的搜索,语音界面或智能帮助,或...

  • 编程语言”这个概念在近几年间已经成为现代科技领域的一个热门话题。它从诞生到今天已经经历了几百年的历史,各个编程语言都各不相同,但其中的共同点无疑就是可以实现一些程序功能。而“未来趋势”,则指的是这一...

  • 这也为java开发人员提供了很好的机会,因为google已经创建了一个出色的基于java的android开发框架-androidstudio。您可能不必掌握我们今天讨论的所有语言,但您的简历中掌握的语言...适合初学者的最佳编程语言之一。...

  • 机器学习使用什么编程语言 …以及为什么是python。 python是机器学习使用的事实上的编程语言。 这是由于它的简单性和可读性,它使用户可以专注于算法和结果,而不是浪费时间在有效地构造代码并保持可管理性上。 ...

  • 网络安全用什么编程语言 要成为网络安全专家,要取得成功,需要多种技能。 全方位的专业人员可以放心地实施和监视安全措施,以保护计算机... 这里有5种最佳编程语言,可帮助您提高网络安全职业的学习能力。 1. ...

  • vb语言vb光盘管理系统设计(源代码 系统)本资源系百度网盘分享地址

  • h型脚架疲劳测试机sw16可编辑_零件图_机械工程图_机械三维3d建模图打包下载.zip

  • 笔记.zip

global site tag (gtag.js) - google analytics
网站地图