2016年12月宣布的腾讯高性能分布式计算平台Angel1.0于今日正式开源。

据了解,Angel是腾讯第三代的计算平台,使用Java和Scala语言开发,面向机器学习的高性能分布式计算框架,由腾讯与香港科技大学、北京大学联合研发。它采用参数服务器架构,解决了上一代框架的扩展性问题,支持数据并行及模型并行的计算模式,能支持十亿级别维度的模型训练。

Angel还采用了SSP(Stale synchronous Parallel)、异步分布式SGD、多线程参数共享模式HogWild、网络带宽流量调度算法、计算和网络请求流水化、参数更新索引和训练数据预处理方案等新技术。这些技术使Angel性能大幅提高,达到常见开源系统Spark的数倍到数十倍,能在千万到十亿级的特征维度条件下运行。

腾讯数据平台部总经理蒋杰曾表示,面对快速增长的数据挖掘需求,开发一个面向机器学习、能应对超大规模数据集的、高性能的计算框架,并且对用户足够友好,具有很低的使用门槛,Angel平台应运而生.

2014年腾讯已走上开源的征途,第一代核心平台TDW-Hive。另外,在第三代的计算框架上对比第二代可以支持10亿级维度的算法训练,由以前的数据并行,到可以支持模型并行。同时,第三代的平台,在系统的易用性上还支持GPU深度学习,支持文本、语音、图像等非结构化的数据。

5857a14dd4e05

Angel自去年初在腾讯内部上线以来,已应用于腾讯视频、腾讯社交广告及用户画像挖掘等精准推荐业务。并且腾讯大数据平台荣获2016年的Sort benchmark全球排序竞赛冠军,98.8秒完成了100T数据排序,刷新了四项世界纪录。2015年的这项排序时间还高达329秒。

腾讯开源平台Angel鼓励了业界工程师、学者和技术人员大规模学习使用,激发机器学习领域的更多创新应用与良好生态发展。

关注中国IDC圈官方微信:idc-quan或微信号:821496803 我们将定期推送IDC产业最新资讯

查看心情排行你看到此篇文章的感受是:


  • 支持

  • 高兴

  • 震惊

  • 愤怒

  • 无聊

  • 无奈

  • 谎言

  • 枪稿

  • 不解

  • 标题党
2017-07-28 13:55:00
大数据资讯 微软、谷歌等巨头争相追逐,芯片成AI的重要战场
在人工智能芯片领域,国内有寒武纪、星光智能一号,国外有IBM真北、谷歌TPU、英伟达,近日微软也加入了这个行列。 <详情>
2017-07-28 09:35:00
云资讯 连通孤岛 加大共享 网络政务破除“拦路虎”
破除数据壁垒并非一朝一夕之事。一些地方和部门,就以“维护信息安全”和“技术不能突破”作为挡箭牌,将政务信息视为“私产”,造成了“信息孤岛”等现象。 <详情>
2017-07-27 09:35:00
大数据资讯 机器换人大潮汹涌而至 唯有思想不可被AI取代
当人类在享受人工智能带来的越来越多的便利时,应当对温水煮青蛙效应保持警惕,而一旦我们让AI代替自己思考,则将很快丧失身份,被其取代。 <详情>
2017-07-27 09:20:00
大数据资讯 从大数据到人工智能 我们还有多远要走?
从云计算到大数据,人工智能已经具备了相对坚实的基础。其中,大数据称得上是人工智能赖以开展的生产资料,而云计算则是人工智能发展的生产工具。 <详情>
2017-07-26 16:11:22
大数据资讯 大数据对六大领域有哪些挑战?
社交媒体的诞生,意味着人不再是抽象的假设,而是一种基于大数据的画像。依据社交媒体里个体行为留痕的数据,就可以对个体进行画像。可以认为,大数据令管理科学真正进入 <详情>