千家论坛_弱电智能化技术与工程讨论(建筑智能,家居智能,人工智能)

资讯交流
收藏本版 |订阅

资讯交流 今日: 21727 |主题: 3424|排名: 6 

发新帖
打印 上一主题 下一主题

想从事大数据工作 如何自学打基础...

[复制链接]
byzoneb 发布于: 2014-6-27 17:23 79 次浏览 0 位用户参与讨论
跳转到指定楼层
海量数据分成两块,一是系统建设技术,二,海量数据应用。
  先说系统建设,现在主流的技术是HADOOP,主要基于mapreduce的分布式框架。目前可以先学习这个。但是云计算服务SaaS软件平台博云网的观点,在分布式系统出来之前,主要是集中式架构,如DB2,oracle。为什么现在用分布式架构,那是因为现在集中式架构受限于IO性能,出来速度慢,如果又一种硬件技术,可以很快地处理海量数据,性能上能满足需求,那么集中式架构优于分布式架构,因为集中式架构稳定,运维压力小。现在的集中式架构要么性能达不到要求,要么就是过于昂贵。我期待一种技术出现,可以非常快地传输和处理数据,那么集中式架构将再次进入人们眼球​。再说海量数据应用。海量数据应用主要是数据挖掘和机器算法。具体有不同的应用场景,如个性化搜索和推荐,社交网络发现,精准营销,精准**,实时最优路径,人工智能等等。看你想做系统支撑技术还是与业务结合的应用技术。


回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册 新浪微博登陆 千家通行证登陆

本版积分规则

千家智客微信号
千家智客微信
玩物说商城
玩物说商城