会议介绍
大会议程
| 2016/3/18 (周五) |
全体会议+展览+晚宴 | ||||
| 2016/3/19 (周六) |
上午 | 待定 |
Hadoop+大数据生态 (Hadoop + Big-data ecosystem) |
大数据基础设施与系统架构 (Big data infrastructure and ecosystem) |
云计算与大数据 ((Big data on cloud) (Docker/OpenStack/SaaS/PaaS)) |
| 下午 |
互联网大数据 (Internet Big data Applications) |
共享经济与大数据 (Share Economy and Big data) |
行业大数据应用 (Big data Applications) |
Spark/NoSQL/机器学习(Spark/NoSQL/Machine learning/Data mining) |
|
| 时间安排 | 3月18日上午 (8:30-12:00) |
全体会议(5个KeyNote) |
| 展览展示 | ||
| 3月18日下午 (1:00-5:30) |
全体会议(5个KeyNote) | |
| 展览展示 | ||
| 3月18日晚 (6:00-9:00) |
行业精英晚宴(受邀嘉宾参加) | |
| 3月19日上午 (9:00-12:00) |
4个分论坛探讨前沿技术及行业案例 | |
| 展览展示 | ||
| 3月19日下午 (1:30-5:30) |
4个分论坛探讨前沿技术及行业案例 | |
| 展览展示 |

廖海仁
品友互动数据架构师
个人简介:
目前供职于品友互动,负责品友DSP算法架构与优化相关工作,2013年品友互动首届全球RTB广告竞价算法大赛的主要组织者之一。有8年以上数据挖掘经验,做过的项目包括数据仓库、推荐系统、计算广告等。本科毕业于清华大学物理系,后在北京大学获得空间物理学硕士学位。研究生毕业后曾参与中国第22次南极科学考察队,在南极中山站越冬14个月,是中澳日合作高空大气观测项目执行人。
主题:贝叶斯思维在DSP竞价算法优化中的应用
内容摘要: DSP竞价优化是一个非常典型的互联网大数据应用,其中涉及到CTR预估、CTR校准、转化优化、人群建模、反作弊等一系列问题与挑战。本次分享我将介绍DSP算法优化中的主要问题及解决思路,尤其会说明在解决这些问题过程中对贝叶斯方法的应用及是否应用贝叶斯思维方式的实际应用差别。同时,做为一位物理背景的数据工作者,我会分享自己对概率论与贝叶斯统计的一些基本问题的思考。
专题演讲—《虚拟化大数据和性能最优化实践》
第八届中国Hadoop大数据峰会会议内容姗姗来迟,小编感到万分抱歉,不过也不负大家所望,总算是整理出来了一些专家演讲的主要内容,现在这里与大家一饱眼福,后续小编会陆续为大家公布其他参会专家及演讲内容。
下面先来看看这第一位美女专家的内容:

Biography:
Xinhui Li is a Staff Engineer at VMware. Her work focuses on design and optimization of distributed systems, mostly in the Cloud Computing and Big Data fields. She works on enabling adoption of new virtualization technologies by Big Data Infrastructure. She is also a core contributor to OpenStack Community. She has 12 international patents, published 3 technical documents, and 5 papers on international PIC top/target academy journal and conferences.
Topic:虚拟化大数据和性能最优化实践
Abstract:
开源项目Serengeti为用户在虚拟化环境中灵活的部署以及管理BigData集群提供了有效的支持。为了保证Hadoop在虚拟化环境中的高效运行,这里分别从硬件选择,集群规划,以及部署样式跟大家分享一些经验。同时我们也从性能调优的经验中抽取了通用参数,由Serenegti在部署过程中自动配置给Hadoop/HBase/Spark集群。希望这些方式可以帮助用户轻松地准备自己的数据中心、在获得虚拟化灵活性的同时享有高性能的大数据分计算体验。
乐视云计算数据平台的演变

张兵兵(Ryan Zhang)乐视云计算有限公司大数据部数据总监,同样也是本届大会程序委员会的委员之一。
张老师是国内互联网最早从事大数据分析处理的研究者之一,擅长结合业务逻辑进行数据分析。7年的电信行业数据仓库、数据建模经验,让张兵兵老师清晰地看到了数据分析在互联网行业里的价值。张兵兵坚信,要“做玩数据的人,不做被数据玩的人”,2005年,张兵兵老师开始了长达10年的互联网数据掘金之旅。
2005年张兵兵老师加入新浪邮箱基础研发部,组建了新浪的第一支数据分析小组,完成邮件用户行为分析系统的开发。07年加入新浪互动社区产品数据部,带领团队负责新浪互动社区全线产品的关键指标建立与分析。
加入乐视网后,深入利用hadoop系列技术,帮助乐视完成对公司主要的运营数据、系统运行数据、收入运营数据、用户行为分析数据等的数据处理与分析。利用上述分析结果,建立了乐视网数据分析体系。
现在在乐视云计算公司大数据部,担任部门总监,负责乐视云计算大数据平台的建设,负责业务指标实时计算、业务建模、DATA+产品、视频标签和用户画像系统。
本次会上分享主题:
《快速构建大数据平台——乐视云计算数据平台的演变》
以过去半年内乐视云计算大数据平台的构建过程为案例,介绍了从一个客户计费系统向实时处理、多维查询系统的演变中,在平台架构设计、计算过程的改造、数据质量等诸多方面的问题、思索与解决方案。探讨大数据平台的构建过程的各种问题。
对eBay零售业的科学数据产品的解读

今天这位专家是位帅锅,他来自eBay的Data Services and Solutions团队,是一位Chief Product Owner。他专注于全球的产品体验和零售优化等分析和数据科学产品的设计和开发,如实时事件监控,网络分析,库存管理,多屏幕分析和接触测量。也有大型数据仓库、商务智能解决方案和自助终端体验设计经验。他写过Transform big data challenge into consumable data product。
那么在此次大会他将与大家分享的专题是什么,看官往下走:
Topic : Growing retail – eBay's retail science data product
Abstract:
eBay is commonly considered an auction site, while in the fact its 70% of inventories are new and fixed priced, and thousands of promotional events are designed and delivered to inspire and delight the customers with the right timing, product and price at any moment. This session will introduce eBay’s exploration of optimizing the business operation of event planning, inventory selection, demand supply gap detection, and real-time monitoring with the big data product powered by science models, the insights gained and the technical implementation.

Jeff Markham
Hortonworks亚太区技术总监
Hortonworks是一家开源Hadoop版本的提供商。在此之前,Jeff曾在VMware,Red Hat和IBM使用分布式数据来帮助企业构建分布式应用程序。他曾为Hadoop的用户组写过Java应用程序开发方面的文章并在会上公开演讲。Jeff对Apache Pig和ApacheHDFS做出过贡献。他也是《Apache Hadoop YARN: Moving Beyond MapReduce and BatchProcessing with Apache Hadoop 2》这本书的合著者。
本次会议Jeff为我们带来了两个议题,分别是Spark与YARN的融合、YARN应用的开发。具体内容请往下看:
Keynote Subject: Spark and YARN
Abstract:Since the introduction of Hadoop 2, YARN hasbeen the cornerstone of new applications built on Hadoop. Applicationscome in various forms: existing open source applications ported to YARN,proprietary software made to run on a Hadoop cluster, or even customapplications. In this session, we’ll talk about how the two most popularopen source projects of the past 5 years have come together. Spark andYARN come together to create a compelling technical and business solution. Find out the latest on what’s happening in this space.
Session Subject: YARN Application Development
Abstract: Building custom applications on top ofYARN is a daunting task. Some frameworks exist to address some of thecomplexity but none address all the issues you’ll face. In this session,we’ll have a code review of a simple application that we can test, debug, anddeploy to YARN. Find out how to incorporate newer YARN features such asthe Registry and Timeline Server into your own custom apps.
eBay的实时信任与安全监控产品

Weirs Sun
eBay数据服务与解决方案团队的高级产品经理,专注于信任和安全领域的大数据产品研发,主导的产品包括eBay的欺诈检测,用户风险管理,反馈,缺陷交易识别,卖方绩效评估等数据产品和分析数据的设计
孙老师此次大会为我们分享的是eBay的实时信任与安全的监控
Topic: eBay’s realtime Trust and Safety violation monitoring
Abstract:
eBay has the world leading Trust and Safety management system, which blocks ATO(Account Taken Over) attack, prevent counterfeit listings, limit high riskusers and so on, thus to ensure the good customer experience on ebaymarketplace. This session will introduce eBay’s real-time rule engineperformance monitoring and how to leverage Hadoop technology for the streamingdata processing, parsing, aggregation and help eBay policy executors timelyreact to the abnormal rule events and traffics.
基于Hadoop的金融大数据平台实践

李均平安集团数据平台部副总工程师
个人简介:李均先后在腾讯和平安集团任职,一直专注于大数据相关的平台规划和系统建设工作,积累了超过8年基于hadoop生态构建超大规模企业应用级数据平台的经验。特别是从互联网行业跨界到金融行业后,对如何搭建适用于不同企业应用场景的数据平台有了自己独到的见解。2005年加入腾讯后,李均从零开始参与负责腾讯大数据平台TDW项目规划和系统建设,离开时腾讯数据平台已经发展成了上万台集群的规模。2013年底,加入平安集团任职数据平台部副总工程师,负责平安大数据平台的战略和系统建设工作。
分享主题:基于Hadoop的金融大数据平台实践
分享内容:
1.金融与互联网公司的数据有何不同
2.金融大数据平台总体架构
3.金融大数据平台实践:
1)安全和隐私保护
2)多数据源跨城实时同步
3)SAS连接Hadoop
4)基于spark的敏捷BI
5)新一代CRM和Campain系统
4.金融大数据应用
1)征信
2)医疗健康
3)车险定价
4)反洗钱

常冰琳小米云平台工程师
长期专注于Hadoop生态的分布式计算框架,Hadoop,Hive和Kudu等多个项目的贡献者,HaodoopNativetask项目发起者。华中科技大学硕士毕业,后在百度搭建数据分析平台以及Hadoop开发,目前在小米利用Impala和Kudu搭建实时数据分析服务。
议题:使用Kudu构建统一实时数据分析服务
Kudu是2015年Cloudera最新公布的开源项目,弥补了在线事务处理(OLTP)和在线分析(OLAP)之前的空白,本演讲将介绍Kudu的设计思想,已经如何利用Kudu简化实时数据分析的架构,提高查询性能。小米作为Kudu最早的用户,分享把kudu整合到现有的Hadoop平台的经验,以及云服务化的一些展望。
2016-01-31 以前购票优惠价:980元;
2016-02-07 以前购票优惠价:1680元;
2016-02-14 以前购票优惠价:2380元;
2016-02-21 以前购票优惠价:2680元;
2016-02-28 以前购票优惠价:2980元;
2016-03-06 以前购票优惠价:3280元;
2016-03-17 以前购票全价: 3500元。
以上票价,2000元以上的,均包含两天中午自助午餐(折扣后,2000元以下票价不含餐);现场会议资料袋。
门票售出概不退票。门票实行实名制,转让门票请务必联系会务组。私自转让门票导致无法入场者,责任自负。
受酒店接待能力所限,现场自助仅供200人就餐,先购票者先得。
300人以外部分,将在酒店外部指定餐厅就餐。
购票5张以上直接获得团体价格。
【会议通知】China Hadoop Summit(中国Hadoop技术峰会)是亚太地区举办最早、规模最大、影响力最广阔的盛会。 2008年诞生于国内最早的Hadoop讨论组, 2009年正式举办第一届大会,到2015年上海站已经是第七届。 大会原名Hadoop in China中国云计算大会,2013年正式更名为China Hadoop Summit(中文名称:中国Hadoop技术峰会)。
会议时间:2016年3月18日-19日8:30-18:00
会议地点:中国·北京 永泰福朋喜来登酒店
会议规模:2,000人(1,000人/日)
主办单位
chinahadoop大数据研究网
北京渠达无限文化传媒有限公司
程序委员会
何建军 : 大会创始人
China Hadoop大数据专业委员会
孙元浩 : 星环科技创始人兼CTO
童小军 : RedHadoop CEO
Easy Hadoop联合创始人
王蔚东 : 数据管理与存储业务发展总监, VMWare
童我剑 : 新浪研发中心总经理
张兵兵 : 乐视云计算 大数据部 数据总监
曹龙龙:阿里云大数据、云计算平台引擎技术专家
田我广 : 博康智能 CTO
Jeff Markham : Hortonworks APAC CTO
戴金权 :Intel亚太研发技术总监,首席工程师
Ted Yu:HBase Committer
李我炜 :Big-data Director, EBay
方我晨 :陆金所大数据负责人
洪钊峰 :曙光 战略规划总监
李亚锋 :电信大数据负责人
徐我磊 :Founder of VSFS; Engineer, Cloudera
参会人群
CTO、技术总监、CEO 、中大型企业CIO
VP、市场与产品总监、市场研究人员与分析师
数据分析总监、数据仓库技术总监
企业系统架构师,大数据架构师
业务咨询专家、企业数据中心经理
数据库管理员,数据库系统工程师
数据领域学者及研发人、风投与传媒人士
大会议题框架
| 主要方向 | 说明 |
| Hadoop大数据生态系 | 大数据安全、YARN、HDFS命名空间等 |
| 计算引擎与实时计算 | Spark、Tez、Impala、FIink、Google Mesa、 Storm、 Kafka等 |
| Big Data as Service | Azure、AWS、阿里云、Docker/Container、Mesos等 |
| NewSQL/SQL | HBase/Druid、 MongoDB/CouchDB、 VoltDB、 MEM SQL、 Hana等 |
| 数据挖掘与图计算 | R语言、GraphLab、GraphX、OrientDB、SequoiaDB等 |
| 机器学习 | 机器学习与人工智能 |
| 数据仓库及可视化 | EBay Kyi in、Facebook Presto、Linkedln Cubert、 QlikView、 Tableaue等 |
| 金融大数据 | 银行、证券、个人征信、企业征信等;量化投资与大数据 |
| 智慧城市 | 交通、医疗、安防、税务工商、旅游等 |
| 大数据与工业4.0 | 电力、电网、能源、炼钢等 |
| 大数据与电子商务 | 京东、阿里、运营商等 |
| 大数据创业与投资 | 分享大数据领域的创业团队和故事,以及如何获 得风险投资,不局限予安用Hadoop技术。 |





