常见的基因组数据库数据价值怎么样

近年来随着测序技术的不断升級,测序通量越来越高同时测序成本直线下降,高通量测序技术逐渐应用在科研、医疗等各个研究领域得到广泛应用伴随着大数据处悝关键技术的突破、数据共享等契机的发展,大数据将在促进生物学发展中发挥重要的作用

测序技术在生物学研究中的发展分成三个阶段:第一个阶段:genome center 唱独角戏。在这个方向刚兴起的初期人才储备较少,产出数据的成本也很大只有少量的国家支持的genome center可以从事这方面嘚系统研究,做生物信息开发的目的也比较明确就是为了完成常见的基因组数据库组中心所承担的一些重大国家科研课题。第二个阶段:高通量测序技术的进步和常见的基因组数据库科技服务公司的崛起当很多科学家看到了有那么多空白的山头待开发,同时数据产出的荿本也大幅降低情况下科学家们对组学研究都跃跃欲试,科技服务的市场需求就出现了同时经过多年的人才储备,也有了一定数量的技术人员为科技服务公司的出现打下了人的基础。这个阶段生物信息开发注重的是“pipeline”这样能提高服务的效率,让公司能更好的发展第三个阶段:大数据的积累和丰富多样的个性化分析需求。随着NGS技术的不断发展测序成本不断降低,数据积累也越来越快同时随着科学家对数据理解的深入,大大开拓了科学家的思路各种个性化的数据分析想法大量涌出脑海,“personalized”成为了这个阶段的生物信息开发要滿足的关键需求目前,测序技术在生物学研究中的应用已经逐渐进入了第三个阶段传统常见的基因组数据库科技服务公司提供的“pipeline”嘚分析结果越来越不能满足科研工作者的需求。一方面是分析的工具和个性化的分析需求得不到满足;另一方面孤立的单个项目的数据汾析形式越来越不能满足科研的需要。

Nature Reviews Genetics报道称目前已发表的高通量测序数据利用率不足20%,很多有价值的信息被研究者所忽略基于公共數据挖掘和分析将成为科学研究发展的趋势。例如2015年Nature Genetics发表的文章通过分析正常组织和各种常见类型癌症组织7256个转录组测序样本,43T转录组數据中鉴定得到58,000个lncRNA;发现上千种lncRNAs在癌症组织中特异表达可以作为新的肿瘤标记物。2014年Genome Biology 发表的文章通过研究13种组织和30个玉米转录组数据中LncRNAs嘚表达鉴定出了20163个推测的LncRNAs,并对LncRNAs的组织特异性的表达调控网络进行了解析最有代表性的是最大的癌症常见的基因组数据库信息的数据庫,Cancer Genome Atlas/TCGA蕴藏着难以想象的宝贵信息围绕TCGA已经有很多重量级文章出现,Pubmed收录的利用其进行数据挖掘发表的文章已经超过1500篇而且对它的使用必然愈发重要。可以说已经公开的高通量测序数据如同“金矿”一般,具有极高的学术价值然而,科研工作者一方面不方便获取符合洎己需求的数据数据的整合、分类、下载也会耗费较多的精力;另一个方面,缺少一个高效、易用的数据分析平台自主搭建一个大

}

导读:本文是近年来不同行业、鈈同领域的大数据公司的一些经典案例总结尽管有些已经是几年前的案例,但其中的深层逻辑对于未来仍有启发

本文力图从企业运营囷管理的角度,梳理出发掘大数据价值的一般规律:一是以数据驱动的决策主要通过提高预测概率,来提高决策成功率;二是以数据驱動的流程主要是形成营销闭环战略,提高销售漏斗的转化率;三是以数据驱动的产品在产品设计阶段,强调个性化;在产品运营阶段则强调迭代式创新。

学习Python中有不明白推荐加入交流裙

01 上篇:天然大数据公司的各种套餐

从谷歌、亚马逊、Facebook、LinkedIn到阿里、百度、腾讯,都洇其拥有大量的用户注册和运营信息成为天然的大数据公司。而像IBM、Oracle、EMC、惠普这类大型技术公司纷纷投身大数据通过整合大数据的信息和应用,给其他公司提供“硬件软件 数据”的整体解决方案我们关注的重点是大数据的价值,第一类公司首当其冲

下面就是这些天嘫大数据公司的挖掘价值的典型案例。

1. 亚马逊的“信息公司”

如果全球哪家公司从大数据发掘出了最大价值截至目前,答案可能非亚马遜莫属亚马逊也要处理海量数据,这些交易数据的直接价值更大

作为一家“信息公司”,亚马逊不仅从每个用户的购买行为中获得信息还将每个用户在其网站上的所有行为都记录下来:页面停留时间、用户是否查看评论、每个搜索的关键词、浏览的商品等等。这种对數据价值的高度敏感和重视以及强大的挖掘能力,使得亚马逊早已远远超出了它的传统运营方式

亚马逊CTO Werner Vogels在CeBIT上关于大数据的演讲,向与會者描述了亚马逊在大数据时代的商业蓝图长期以来,亚马逊一直通过大数据分析尝试定位客户和和获取客户反馈。

“在此过程中伱会发现数据越大,结果越好为什么有的企业在商业上不断犯错?那是因为他们没有足够的数据对运营和决策提供支持,”Vogels说“一旦进叺大数据的世界,企业的手中将握有无限可能”从支撑新兴技术企业的基础设施到消费内容的移动设备,亚马逊的触角已触及到更为广闊的领域

亚马逊推荐:亚马逊的各个业务环节都离不开“数据驱动”的身影。在亚马逊上买过东西的朋友可能对它的推荐功能都很熟悉“买过X商品的人,也同时买过Y商品”的推荐功能看上去很简单却非常有效,同时这些精准推荐结果的得出过程也非常复杂

亚马逊预測:用户需求预测是通过历史数据来预测用户未来的需求。对于书、手机、家电这些东西——亚马逊内部叫硬需求的产品你可以认为是“标品”——预测是比较准的,甚至可以预测到相关产品属性的需求但是对于服装这样软需求产品,亚马逊干了十多年都没有办法预测嘚很好因为这类东西受到的干扰因素太多了,比如:用户的对颜色款式的喜好穿上去合不合身,爱人朋友喜不喜欢…… 这类东西太易變买得人多反而会卖不好,所以需要更为复杂的预测模型

亚马逊测试:你会认为亚马逊网站上的某段页面文字只是碰巧出现的吗?其实,亚马逊会在网站上持续不断地测试新的设计方案从而找出转化率最高的方案。整个网站的布局、字体大小、颜色、按钮以及其他所有嘚设计其实都是在多次审慎测试后的最优结果。

亚马逊记录:亚马逊的移动应用让用户有一个流畅的无处不在的体验的同时也通过收集手机上的数据深入地了解了每个用户的喜好信息;更值得一提的是Kindle Fire,内嵌的Silk浏览器可以将用户的行为数据一一记录下来

以数据为导向的方法并不仅限于以上领域,亚马逊的企业文化就是冷冰冰的数据导向型文化对于亚马逊来说,大数据意味着大销售量数据显示出什么昰有效的、什么是无效的,新的商业投资项目必须要有数据的支撑对数据的长期专注让亚马逊能够以更低的售价提供更好的服务。

如果說有一家科技公司准确定义了“大数据”概念的话那一定是谷歌。根据搜索研究公司comScore的数据仅2012年3月一个月的时间,谷歌处理的搜索词條数量就高达122亿条谷歌的体量和规模,使它拥有比其他大多数企业更多的应用大数据的途径

谷歌搜索引擎本身的设计,就旨在让它能夠无缝链接成千上万的服务器如果出现更多的处理或存储需要,抑或某台服务器崩溃谷歌的工程师们只要再添加更多的服务器就能轻松搞定。将所有这些数据集合在一起所带来的结果是:企业不仅从最好的技术中获益同样还可以从最好的信息中获益。下面选择谷歌公司的其中三个亮点

谷歌意图:谷歌不仅存储了搜索结果中出现的网络连接,还会储存用户搜索关键词的行为它能够精准地记录下人们進行搜索行为的时间、内容和方式,坐拥人们在谷歌网站进行搜索及经过其网络时所产生的大量机器数据这些数据能够让谷歌优化广告排序,并将搜索流量转化为盈利模式谷歌不仅能追踪人们的搜索行为,而且还能够预测出搜索者下一步将要做什么用户所输入的每一個搜索请求,都会让谷歌知道他在寻找什么所有人类行为都会在互联网上留下痕迹路径,谷歌占领了一个绝佳的点位来捕捉和分析该路徑换言之,谷歌能在你意识到自己要找什么之前预测出你的意图这种抓取、存储并对海量人机数据进行分析,然后据此进行预测的能仂就是数据驱动的产品。

谷歌分析:谷歌在搜索之外还有更多获取数据的途径企业安装“谷歌分析”之类的产品来追踪访问者在其站點的足迹,而谷歌也可获得这些数据网站还使用“谷歌广告联盟”,将来自谷歌广告客户网的广告展示在其站点因此,谷歌不仅可以洞察自己网站上广告的展示效果同样还可以对其他广告发布站点的展示效果一览无余。

谷歌趋势:既然搜索本身是网民的“意图数据库”当然可以根据某一专题搜索量的涨跌,预测下一步的走势谷歌趋势可以预测旅游、地产、汽车的销售。此类预测最著名的就是谷歌鋶感趋势跟踪全球范围的流感等病疫传播,依据网民搜索分析全球范围内流感等病疫的传播状况。

早在2006年eBay就成立了大数据分析平台。为了准确分析用户的购物行为eBay定义了超过500种类型的数据,对顾客的行为进行跟踪分析eBay分析平台高级总监Oliver Ratzesberger说:“在这个平台上,可以將结构化数据和非结构化数据结合在一起通过分析促进eBay的业务创新和利润增长。”

eBay行为分析:在早期eBay网页上的每一个功能的更改,通瑺由对该功能非常了解的产品经理决定判断的依据主要是产品经理的个人经验。而通过对用户行为数据的分析网页上任何功能的修改嘟交由用户去决定。“每当有一个不错的创意或者点子我们都会在网站上选定一定范围的用户进行测试。通过对这些用户的行为分析來看这个创意是否带来了预期的效果。”

eBay广告分析:更显著的变化反映在广告费上eBay对互联网广告的投入一直很大,通过购买一些网页搜索的关键字将潜在客户引入eBay网站。

4. 塔吉特的“数据关联挖掘”

利用先进的统计方法商家可以通过用户的购买历史记录分析来建立模型,预测未来的购买行为进而设计促销活动和个性服务避免用户流失到其他竞争对手那边。

美国第三大零售商塔吉特通过分析所有女性愙户购买记录,可以“猜出”哪些是孕妇其发现女性客户会在怀孕四个月左右,大量购买无香味乳液由此挖掘出25项与怀孕高度相关的商品,制作“怀孕预测”指数推算出预产期后,就能抢先一步将孕妇装、婴儿床等折扣券寄给客户。

塔吉特还创建了一套购买女性行為在怀孕期间产生变化的模型不仅如此,如果用户从它们的店铺中购买了婴儿用品它们在接下来的几年中会根据婴儿的生长周期定期給这些顾客推送相关产品,使这些客户形成长期的忠诚度

5. 中国移动的数据化运营

通过大数据分析,中国移动能够对企业运营的全业务进荇针对性的监控、预警、跟踪大数据系统可以在第一时间自动捕捉市场变化,再以最快捷的方式推送给指定负责人使他在最短时间内獲知市场行情。

客户流失预警:一个客户使用最新款的诺基亚手机每月准时缴费、平均一年致电客服3次,使用WEP和彩信业务如果按照传統的数据分析,可能这是一位客户满意度非常高、流失概率非常低的客户事实上,当搜集了包括微博、社交网络等新型来源的客户数据の后这位客户的真实情况可能是这样的:客户在国外购买的这款手机,手机中的部分功能在国内无法使用在某个固定地点手机经常断線,彩信无法使用——他的使用体验极差正在面临流失风险。这就是中国移动一个大数据分析的应用场景通过全面获取业务信息,可能颠覆常规分析思路下做出的结论打破传统数据源的边界,注重社交媒体等新型数据来源通过各种渠道获取尽可能多的客户反馈信息,并从这些数据中挖掘更多的价值

数据增值应用:对运营商来说,数据分析在政府服务市场上前景巨大运营商也可以在交通、应对突發灾害、维稳等工作中使大数据技术发挥更大的作用。运营商处在一个数据交换中心的地位在掌握用户行为方面具有先天的优势。作为信息技术的又一次变革大数据的出现正在给技术进步和社会发展带来全新的方向,而谁掌握了这一方向谁就可能成功。对于运营商来說在数据处理分析上,需要转型的不仅是技巧和法律问题更需要转变思维方式,以商业化角度思考大数据营销

Twitter兴趣聚类:通过过滤鼡户归属地、发推位置和相关关键词,Twitter建立了一系列定制化的客户数据流比如,通过过滤电影片名、位置和情绪标签你可以知道洛杉磯、纽约和伦敦等城市最受欢迎的电影是哪些。而根据用户发布的个人行为描述你甚至能搜索到那些在加拿大滑雪的日本游客。从这个視角看Twitter的兴趣图谱的效率优于Facebook的社交图谱。Twitter的用户数据所能产生的潜在价值同样令人惊叹在社交媒体网站正在收集越来越多的数据的形势下,它们或许能找到更好的方式来利用这些数据盈利并使其取代广告成为自身提高收入的主要方式。这些社交网站真正的价值可能茬于数据本身相信在不久的将来,如果寻找到既能充分利用用户数据又可合理规避对用户隐私的威胁,社交数据所蕴藏的巨大能量将會彻底被开启

Twitter情绪分析:Twitter自己并不经营每一款数据产品,但它把数据授权给了像DataSift这样的数据服务公司很多公司利用Twitter社交数据,做出了各种让人吃惊的应用从社交监测到医疗应用,甚至可以去追踪流感疫情爆发社交媒体监测平台DataSift还创造了一款金融数据产品。华尔街“德温特资本市场”公司首席执行官保罗·霍廷每天的工作之一,就是利用电脑程序分析全球3.4亿微博账户的留言进而判断民众情绪,再以“1”到“50”进行打分根据打分结果,霍廷再决定如何处理手中数以百万美元计的股票霍廷的判断原则很简单:如果所有人似乎都高兴,那就买入;如果大家的焦虑情绪上升那就抛售。一些媒体公司会把观众收视率数据打包到产品里再转卖给频道制作人和内容创造者。

精确的数据一旦与社交媒体数据相结合对未来的预测会非常准。

7. 特易购的精准定向

聪明的商家通过用户的购买历史记录分析来建立模型为他们量身预测未来的购物清单,进而设计促销活动和个性服务让他们源源不断地为之买单。

特易购是全球利润第二大的零售商这镓英国超级市场巨人从用户行为分析中获得了巨大的利益。从其会员卡的用户购买记录中特易购可以了解一个用户是什么“类别”的客囚,如速食者、单身、有上学孩子的家庭等等

这样的分类可以为提供很大的市场回报,比如通过邮件或信件寄给用户的促销可以变得┿分个性化,店内的促销也可以根据周围人群的喜好、消费的时段来更加有针对性从而提高货品的流通。这样的做法为特易购获得了丰厚的回报仅在市场宣传一项,就能帮助特易购每年节省3.5亿英镑的费用

Tesco的优惠券:特易购每季会为顾客量身定做6张优惠券。其中4张是客戶经常购买的货品而另外2张则是根据该客户以往的消费行为数据分析,极有可能在未来会购买的产品仅在1999年,特易购就送出了14.5万份面姠不同的细分客户群的购物指南杂志和优惠券组合更妙的是,这样的低价无损公司整体的盈利水平通过追踪这些短期优惠券的回笼率,了解到客户在所有门店的消费情况特易购还可以精确地计算出投资回报。发放优惠券吸引顾客其实已经是很老套的做法了而且许多嘚促销活动实际只是来掠夺公司未来的销售额。然而依赖于扎实的数据分析来定向发放优惠券的特易购,却可以维持每年超过1亿英镑的銷售额增长

特易购同样有会员数据库,通过已有的数据就能找到那些对价格敏感的客户,然后在公司可以接受的最低成本水平上为這类顾客倾向购买的商品确定一个最低价。这样的好处一是吸引了这部分顾客二是不必在其他商品上浪费钱降价促销。

特易购的精准运營:这家连锁超市在其数据仓库中收集了700万部冰箱的数据通过对这些数据的分析,进行更全面的监控并进行主动的维修以降低整体能耗

Facebook是社交网络巨擎,但是在挖掘大数据价值方面好像办法不多,值得一提的就是好友推荐

Facebook使用大数据来追踪用户在其网络的行为,通過识别你在它的网络中的好友从而给出新的好友推荐建议,用户拥有越多的好友他们与Facebook之间的黏度就越高。更多的好友意味着用户会汾享更多照片、发布更多状态更新、玩更多的游戏

LinkedIn网站使用大数据在求职者和招聘职位之间建立关联。有了LinkedIn猎头们再也不用向潜在的受聘者打陌生电话来碰运气,而可以通过简单的搜索找出潜在受聘者并联系他们

与此相似,求职者也可以通过联系网站上其他人自然洏然地将自己推销给潜在的雇主。有两个例子能够生动呈现LinkedIn的数据价值:几年前LinkedIn忽然发现近期雷曼兄弟的来访者多了起来,当时并没引起重视过了不久,雷曼兄弟宣布倒闭;而在谷歌宣布退出中国的前一个月在LinkedIn发现了一些平时很少见的谷歌产品经理在线,这也是相同嘚道理

10. 沃尔玛的数据常见的基因组数据库

早在1969年沃尔玛就开始使用计算机来跟踪存货,1974年就将其分销中心与各家商场运用计算机进行库存控制1983年,沃尔玛所有门店都开始采用条形码扫描系统

1987年,沃尔玛完成了公司内部的卫星系统的安装该系统使得总部,分销中心和各个商场之间可以实现实时双向的数据和声音传输。采用这些在当时还是小众和超前的信息技术来搜集运营数据为沃尔玛最近20年的崛起咑下了坚实的地基从而发现了“啤酒与尿布”关联。

如今沃尔玛拥有着全世界最大的数据仓库,在数据仓库中存储着沃尔玛数千家连鎖店在65周内每一笔销售的详细记录这使得业务人员可以通过分析购买行为更加了解他们的客户。

通过这些数据业务员可以分析顾客的購买行为,从而供应最佳的销售服务沃尔玛一直致力于改善自身的数据收集技术,从条形码扫描到安装卫星系统实现双向数据传输,整个公司都充满了数据常见的基因组数据库

2012年4月,沃尔玛又收购了一家研究网络社交常见的基因组数据库的公司Kosmix在数据常见的基因组數据库的基础上,又增加了社交常见的基因组数据库

11. 阿里小贷和聚石塔

虽然阿里系的余额宝如日中天,但其实阿里小贷才真正体现出了夶数据的价值早在2010年阿里就已经建立了“淘宝小贷”,通过对贷款客户下游订单、上游供应商、经营信用等全方位的评估就可以在没囿见面情况下,给客户放款这当然是对阿里平台上大数据的挖掘。

数据来源于“聚石塔”——一个大型的数据分享平台它通过共享阿裏巴巴旗下各个子公司的数据资源来创造商业价值。这款产品就是大数据团队把淘宝交易流程各个环节的数据整合互联然后基于商业理解对信息进行分类储存和分析加工,并与决策行为连接起来所产生的效果

12. 西尔斯的数据大集成

在过去,美国零售巨头西尔斯控股公司需要八周时间才能制定出个性化的销售方案,但往往做出来的时候它已不再是最佳方案。

痛定思痛决定整合其专售的三个品牌——Sears、Craftsman、Lands‘End的客户、产品以及销售数据,使用群集收集来自不同品牌的数据并在群集上直接分析数据,而不是像以前那样先存入数据仓库避免了浪费时间——先把来自各处的数据合并之后再做分析。

这种调整让公司的推销方案更快、更精准可以从海量信息中挖掘价值,但是價值巨大困难也巨大:这些数据需要超大规模分析,且分散在不同品牌的数据库与数据仓库中不仅数量庞大而且支离破碎。

西尔斯的困境在传统企业中非常普遍,这些企业家一直想不通既然互联网零售商亚马逊可以推荐阅读书目、推荐电影、推荐可供购买的产品,為什么他们所在的企业却做不到类似的事情

西尔斯公司首席技术官菲里·谢利(Phil Shelley)说:如果要制定一系列复杂推荐方案质量更高,需要更及時、更细致、更个性化的数据传统企业的IT架构根本不能完成这些任务,需要痛下决心才能完成转型。

02 中篇:轻公司数据创业狂欢

在“數据盛宴”中是否只有大公司的狂欢?并非如此,从事大数据产业的轻公司将无处不在新兴的创业公司通过出售数据和服务更有针对性哋提供单个解决方案,把大数据商业化、商品化才是更加值得我们关注的模式。这将带来继门户网站、搜索引擎、社交媒体之后的新一波创业浪潮和产业革命并会对传统的咨询公司产生强烈冲击。

PredPol公司通过与洛杉矶和圣克鲁斯的警方以及一群研究人员合作基于地震预測算法的变体和犯罪数据来预测犯罪发生的几率,可以精确到500平方英尺的范围内在洛杉矶运用该算法的地区,盗窃罪和暴力犯罪分布下降了33%和21%

Tipp24 AG针对欧洲博彩业构建的下注和预测平台。该公司用KXEN软件来分析数十亿计的交易以及客户的特性然后通过预测模型对特定用户进荇动态的营销活动。这项举措减少了90%的预测模型构建时间SAP公司正在试图收购KXEN,“SAP想通过这次收购来扭转其长久以来在预测分析方面的劣勢”

交通的参与者多种多样,是大数据最能发挥价值的领域交通流量数据公司Inrix依靠分析历史和实时路况数据,能给出及时的路况报告以帮助司机避开正在堵车的路段,并且帮他们提前规划好行程汽车制造商、移动应用开发者、运输企业以及各类互联网企业都需要Inrix的蕗况报告。奥迪、福特、日产、微软等巨头都是Inrix的客户

16. 潘吉瓦的时尚预测

消费者追寻意见领袖的生活方式。潘吉瓦公司就是用数据分析來预测流行趋势以此为基础甚至撬动全球贸易。比如它们通过41次追踪《暮光之城》的徽章、袜子的运输情况,分析在这部电影中主角嘚服饰对流行趋势有多大影响率并将分析结果告知用户,建议他们对自己的行动做出恰当的调整

17. 潘多拉的音乐推荐

美国在线音乐网站潘多拉特别聘请一些音乐专家,让他们每个人平均花上20分钟去分析一首歌曲并赋予每首歌400种不同的属性。如果你表示喜欢一首歌程序會自动寻找跟这首歌“常见的基因组数据库”相同的歌曲,猜测你也会喜欢并采用推荐引擎技术推荐给你借助这种人海战术,潘多拉网站已经分析了74万首歌曲

Futrix Health是一家专注于用通过数据为患者制定医疗解决方案的公司,从安装在智能手机上的个人健康应用到诊所、医院裏医生使用的电子健康记录仪,甚至是革命性的数字化常见的基因组数据库组数据均连接到后端数据仓库上。从而为患者制定最佳的医院选择、医药选择

该如何将采集到医疗保健机构的大量操作信息,分析患者情况或治疗效果实施任何高效率的措施,使之更具有意义——大数据时代提供的机会不再是简单地收集这些数据,而是如何运用数据来更好地认知这个世界

在零售领域,创业公司Retention Science发布了一个為电子商务企业提供增强用户粘性的数据分析及市场策略设计的平台它的用户建模引擎具备自学习功能,通过使用算法和统计模型来设計优化用户粘性的策略

平台的用户数据分析都是实时进行,以确保用户行为预测总是符合实际用户行为更新;同时动态的根据这些行為预测来设计一些促销策略。RS目前已获得Baroda Ventures, Mohr Davidow Ventures, Double M Partners及一些著名天使投资人130万美金的投资

20. 众瀛的婚嫁后推荐

江苏众瀛联合数据科技有限公司构建了這样一个大数据平台——将准备结婚的新人作为目标消费者,并把与结婚购物相关的商家加入其中

一对新人到薇薇新娘婚纱影楼拍了婚紗照,在实名登记了自己的信息后会被上传到大数据平台上大数据平台能根据新人在婚纱影楼的消费情况和偏好风格,大致分析判断出噺人后续消费需求即时发送奖励和促销短信。

比如邀请他们到红星美凯龙购买家具、到红豆家纺选购床上用品、到国美电器选购家用电器、到希尔顿酒店摆酒席……如果新人在红星美凯龙购买了中式家具说明他们偏好中国传统文化,就推荐他们购买红豆家纺的中式家居鼡品

水,向来是个不好管理的东西:自来水公司发现某个水压计出现问题可能需要花上很长的时间排查共用一个水压计的若干水管。等找到的时侯大量的水已经被浪费了。以色列一家名为Takadu的水系统预警服务公司解决了这个问题

Takadu把埋在地下的自来水管道水压计、用水量和天气等检测数据搜集起来,通过亚马逊的云服务传回Takadu公司的电脑进行算法分析如果发现城市某处地下自来水管道出现爆水管、渗水鉯及水压不足等异常状况,就会用大约10分钟完成分析生成一份报告发回给这片自来水管道的维修部门。

报告中除了提供异常状况类型鉯及水管的损坏状况——每秒漏出多少立方米的水,还能相对精确地标出问题水管具体在哪里检测每千米“水路”,Takadu的月收费是1万美元

22. 百合网的婚恋匹配

电商行业的现金收入源自数据,而婚恋网站的商业模型更是根植于对数据的研究比如,作为一家婚恋网站百合网鈈仅需要经常做一些研究报告,分析注册用户的年龄、地域、学历、经济收入等数据即便是每名注册用户小小的头像照片,这背后也大囿挖掘的价值

百合网研究规划部李琦曾经对百合网上海量注册用户的头像信息进行分析,发现那些受欢迎头像照片不仅与照片主人的长楿有关同时照片上人物的表情、脸部比例、清晰度等因素也在很大程度上决定了照片主人受欢迎的程度。

例如对于女性会员,微笑的表情、直视前方的眼神和淡淡的妆容能增加自己受欢迎的概率而那些脸部比例占照片1/2、穿着正式、眼神直视没有多余pose的男性则更可能成為婚恋网站上的宠儿。

Prismatic是一款个性化新闻应用只有4名创始员工,凭借互联网数据爬虫和社交网络开发平台的数据依托亚马逊的云计算岼台,实现了大数据的精益创业

Prismatic不提供统一的设计精良的新闻订阅或推荐界面,而是根据分析用户的Facebook 或Twitter资料为用户做一对一的数据分析和推荐。

从盈利模式来看Prismatic不是依靠广告费生存下来,也不是传统的新闻媒介而是一个披着新闻应用外衣的电子商务公司。名义上为叻给用户个性化推荐新闻而得到用户的个人信息进行数据分析针对性的推出推荐商品,从而从电子商务中盈利

人类都有和同类对比的忝性,例如一家政府机构收集不同地点从事同类工作的多组员工的数据,仅仅将这些信息公诸于众就促使落后员工提高了绩效

在能源荇业,Opower使用数据对比来提高消费用电的能效并取得了显著的成功。作为一家SaaS的创新公司Opower与多家电力公司合作,分析美国家庭用电费用並将之与周围的邻居用电情况进行对比被服务的家庭每个月都会受到一份对比的报告,显示自家用电在整个区域或全美类似家庭所处水岼以鼓励节约用电。

Opower的服务以覆盖了美国几百万户居民家庭预计将为美国消费用电每年节省5亿美元。Opower报告信封看上去像账单,它们使用行为技术轻轻地说服公用事业客户降低消耗

Opower已经推出了它的大数据平台 Opower4 ,通过分析各种智能电表和用电行为电力公司等公用事业單位成为Opower的盈利来源。而对一般用户而言Opower完全是免费的。

使用新的数据技术诸如美国的Chango公司和中国的Uniqlick公司正在数字广告行业中探索新嘚商业模式——实时竞拍数字广告。

通过了解互联网用户在网络的搜索、浏览等行为这些公司可以为广告主提供最有可能对其商品感兴趣的用户群,从而进行精准营销;更长期的趋势是将广告投放给最有可能购买的用户群。

这样的做法对于广告主来说可以获得更高的转換率,而对于发布广告的网站来说也提高了广告位的价值。

26. 众趣的行为辩析

众趣是国内第一家社交媒体数据管理平台目前国内主要的社交开放平台在用户数据的开放性方面仍比较保守,身为第三方数据分析公司能够获得的用户数据还十分有限,要使用这些用户数据需獲得用户许可

众趣通过运营统计学等相关数据分析原理对用户数据进行过滤,最终完成的是对一个用户的行为、动作等个体特征的描述这些描述可以帮助品牌营销者了解消费者的消费习惯及需求;也可以帮助企业的领导增强对自己员工的了解。除了对个体以及群体行为特征的描述外这些数据分析结果还可用于对用户群体的行为预测,从而为营销者提供一些前瞻性的市场分析

众趣数据分析的结果只能精准到群组而无法达到个人。此类的用户数据研究除在市场营销领域具有一定的参考价之外目前大多还主要用于配合一些小调研。此外这些数据还可以实现对用户甚至企业机构的信用评级,在金融领域也有一定程度的使用

27. 拖拉网的明天猜想

导购电商的拖拉网制作了“奣天穿什么”这一应用。在这个应用当中众多时装圈权威人士输送时装搭配与风格单品,由用户任意打分根据用户的打分偏好,拖拉網便能猜到明天她们想穿什么然后为她在数十万件网购时装中推荐单品,并且实现直通购买下单在获取客户数据后,后台分析也是各顯神通

拖拉网加入了更多变量来考核自己的推荐模式。比如有消费者明天要参加一个聚会不知道要穿什么风格,也没有看天气预报唏望导购网站能帮她把这些场景和自己的信息组合起来,给出一整套的解决方案

于是日期、地域、场合、风格,这些都成为穿衣搭配解決方案的变量经过不断的组合呈现给用户,据拖拉网数据用户在看到一个比较优质的搭配,并有场景性引导的时候点击到最后页面唍成购买的转化率会比单品推荐高40%。

现在人们有了把人类常见的基因组数据库档案序列化的能力这允许医生和科学家去预测病人对于某些疾病的易感染性和其他不利的条件,可以减少治疗过程的时间和花费

位于旧金山的SeeChange公司创建了一套新的健康保险模式。该公司通过分析客户的个人健康记录、医疗报销记录、以及药店的数据来判断该客户对于慢性病的易感性,并判断该客户是否有可能从一些定制的康複套餐中获利

SeeChange同时设计健康计划,并设立奖励机制鼓励客户主动完成健康行动全过程都通过其数据分析引擎来监控。

以色列的Given Imaging公司发奣了一种胶囊内置摄像头,患者服用后胶囊能以大约每秒14张照片的频率拍摄消化道内的情况并同时传回外置的图像接收器,患者病征通过配套的软件被录入数据库在4至6小时内胶囊相机将通过人体排泄离开体外。

一般来说医生都是在靠自己的个人经验进行病征判断,難免会对一些疑似阴影拿捏不准甚至延误病人治疗现在通过Given Imaging的数据库,当医生发现一个可疑的肿瘤时双击当前图像后,过去其他医生拍摄过的类似图像和他们的诊断结果都会悉数被提取出来

可以说,一个病人的问题不再是一个医生在看而是成千上万个医生在同时给絀意见,并由来自大量其他病人的图像给出佐证这样的数据对比,不但提高了医生诊断的效率还提升了准确度。

真正的技术人才永远昰各大公司的抢手货绝对不要坐等他们向你投简历,因为在他们还没有机会写简历之前很可能已经被其他公司抢走了Entelo公司能替企业家們推荐那些才刚刚萌发跳槽动机的高级技术人才,以便先下手为强

Entelo的数据库里目前有3亿份简历。而如何判断高级人才的跳槽倾向Entelo有一套正在申请专利的算法。这套算法有70多个指标用于判定跳槽倾向某公司的股价下跌、高层大换血、刚被另一大公司收购,这些都会被Entelo看莋是导致该公司人才跳槽的可能性因素

于是Entelo就会立刻把该公司里的高级人才的信息推送给订阅了自己服务的企业家们。企业家们收到的簡历跟一般的简历还不一样Entelo抓取了这些人才在各大社交网络的信息。这样企业家们可以了解该人提交过哪些代码在网上都回答了些什麼样的问题,在Twitter上都发表的是些什么样的信息

总之,这些准备“挖角”的企业家能够看到一个活生生的目标人才站在面前

航空业分秒必争,尤其是航班抵达的准确时间如果一班飞机提前到达,地勤人员还没准备好乘客和乘务员就会被困在飞机上白白耽误时间;如果一癍飞机延误,地勤人员就只能坐着干等白白消耗成本。

美国一家大航空公司从其内部报告中发现大约10%的航班的实际到达时间与预计到達时间相差10分钟以上,30%的航班相差5分钟以上FlightCaster是一家提供航班延误信息预测的公司,主要根据航空公司的航班运行情况进行预测

与航空公司所拥有的类似航班运行情况的专有信息一样,该公司拥有大量国内航班飞行和航班实时运行状况的历史数据Flightcaster的秘诀就是其对大数据汾析的有效利用和使用适当的软件工具对产出数据进行实时管理。

Passur Aerospace是专门为航空业提供决策支持的技术公司通过搜集天气、航班日程表等公开数据,结合自己独立收集的其他影响航班因素的非公开数据综合预测航班到港时间。时至2012年Passur公司已经拥有超过155处雷达接收站,烸4.6秒就收集一次雷达上每架飞机的一系列信息这会持续地带来海量数据。

不仅如此经过长期的数据收集,Passur拥有了一个超过十年的巨大嘚多维信息载体为透彻的分析和恰当的数据模型提供了可能。Passur公司相信航空公司依据它们提供的航班到达时间做计划,能为每个机场烸年节省数百万美元

一家名为气候公司的创业企业每天都会对美国境内超过100万个地点、未来两年的天气情况进行超过1万次模拟,其数据量庞大、动态、实时随后,该公司将根系结构和土壤孔隙度的相关数据与模拟结果相结合,为成千上万的农民提供农作物保险

通过遙感获取土壤数据,这和我们过去所熟悉的通过网络服务获取用户网络行为数据不是一回事数据的概念得以极大的扩充。要想对每块田哋提供精准的保险服务肯定还需要与土地数据相配套的农产品期货、气候预测、国际贸易、国际政治和军事安全、国民经济,产业竞争等等各方面的数

在如此庞杂的大数据基础上推出的商业模式是创新的,同现有农作物保险方式相比具备极大竞争力并且是可持续和规模化的。更妙的是这家公司基于大数据的运营,完全没有进行高额的网络设施投资只是租用了亚马逊的公共云服务,一个月几万美元洏已

几乎所有的收费电子书都会提供部分章节让读者试读,其实出版商需要弄清楚人们读到了哪里、读完后有没有购买,以及其他各種体验才能卖出更多的电子书。

美国创业公司Hiptype开发了一套电子书阅读分析工具其商业模式就在试图解决这一难题。Hiptype自称为“面向电子書的Google Analytics”能够提供与电子书有关的丰富数据。它不仅能统计电子书的试读和购买次数还能绘制出“读者图谱”,包括用户的年龄、收入囷地理位置等

此外,它还能告诉出版商读者在看完免费章节后是否进行了购买有多少读者看完了整本书,以及读者平均看了多少页讀者最喜欢从哪个章节开始看,又在哪个章节半途而废等等。

Hiptype能够与电子书整合在一起出版商无论选择哪种渠道,总是能够获得用户數据Hiptype收集的所有数据都是匿名的。用户在下载了内置Hiptype服务的电子书时会得到一个提示,可以选择将其屏蔽

34. 安客诚的“人网合一”

网絡营销存在一个巨大问题,如何获知在网上使用几个不同名称的人是否是同一个人?安诚客推出了一种名为“观众操作系统”的技术方案解決了这个问题它允许市场营销者与你的 “数字人物”绑定,即使你由于婚姻换了名字或者使用昵称,或者偶尔使用中名它也照样能夠解答那个已经换了地址或者电话号码的人是否是同一个人的问题。

AOS 可以汇集不同数据库中的信息这些数据或离线或在线,是公司可能茬不同场合针对个人而收集的通过使用AbiliTec——一种Acxiom也拥有的数字化“身份识别”技术——AOS将客户信息删繁就简,得到简单单一的结果AOS帮助安诚客的广告客户使用他们的数据在Facebook上找到广告投放目标用户。

03 下篇:数据关联、数据废气和黑暗数据

大数据主要不作因果判断主要適用于关联分析。很多关联分析并不需要复杂的模型只需要具有大数据的意识。

很多机构都有数据废气数据不是用完就是被舍弃,它嘚再利用价值也许你现在不清楚但在未来的某一刻,它会迸发出来可以化废为宝。

黑暗数据就是那些针对单一目标而收集的数据通瑺用过之后就被归档闲置,其真正价值未能被充分挖掘如果黑暗数据用在恰当的地方,也能公司的事业变得光明

某公司团队曾经使用來自手机的位置数据,来推测美国圣诞节购物季开始那一天有多少人在梅西百货公司的停车场停车进而可以预测其当天的销售额,这远早于梅西百货自己统计出的销售记录无论是华尔街的分析师或者传统产业的高管,都会因这种敏锐的洞察力获得极大的竞争优势

对于稅务部门来说,税务欺骗正在日益的被关注这时大数据可以用于增加政府识别诈骗的流程。在隐私允许的地方政府部门可以综合各个方面的数据比如车辆的登记,海外旅游的数据来发现个人的花费模式使税务贡献不被叠加。同时一个可疑的问题出现了这并没有直接嘚证据指向诈骗,这些结论并不能用来去控告个人但是他可以帮助政府部门去明确他们的审计和其他的审核以及一些流程。

物流公司的數据原来只服务于运营需要但一经再利用,物流公司就华丽转身为金融公司数据用以评估客户的信用,提供无抵押贷款或者拿运送途中的货品作为抵押提供贷款;物流公司甚至可以转变为金融信息服务公司来判断各个细分经济领域的运行和走势。

有公司已经在大数据中囿接近“上帝俯视”的感觉美国洛杉矶的一家企业宣称,他们将全球夜景的历史数据建立模型在过滤掉波动之后,做出了投资房地产囷消费的研究报告

麦当劳则通过外送服务,在售卖汉堡的同时获得了用户的精准地址这些地址数据汇集之后,就变成了一份绝妙的房哋产业的内部数据

在特定情况下,黑暗数据可以用作其他用途Infinity Property & Casualty公司用累积的理赔师报告来分析欺诈案例,通过算法挽回了1200万美元的代位追偿金额一家电气销售公司,通过积累10年ERP销售数据分析按照电气设备的生命周期,给5年前的老客户逐一拜访获得了1000万元以上电气設备维修订单,顺利地进入MRO市场

美国运通以前只能实现事后诸葛亮式的报告和滞后的预测,传统的BI已经无法满足其业务发展的需要

于昰,AmEx开始构建真正能够预测客户忠诚度的模型基于历史交易数据,用115个变量来进行分析预测该公司表示,对于澳大利亚将于之后4个月Φ流失的客户已经能够识别出其中的24%。这样的客户流失分析当然可以用于挽留客户。

酒店业可以为消费者定制相应的独特的个性房间甚至可以在墙纸上放上消费者的微博的旅游心情等等。旅游业可以根据大数据为消费者提供其可能会喜好的本地特色产品、活动、小而媄的小众景点等等来挽回游客的心

39. 快餐业的视频分析

快餐业的公司可以通过视频分析等候队列的长度,然后自动变化电子菜单显示的内嫆如果队列较长,则显示可以快速供给的食物;如果队列较短则显示那些利润较高但准备时间相对长的食品。

2012年参与竞选的奥巴马团隊确定了三个最根本的目标:让更多的人掏更多的钱,让更多的选民投票给奥巴马让更多的人参与进来!

这需要“微观”层面的认知:烸个选民最有可能被什么因素说服?每个选民在什么情况下最有可能掏腰包什么样的广告投放渠道能够最高效获取目标选民?如竞选总指挥吉姆·梅西纳所说,在整个竞选活中,没有数据做支撑的假设不能存在。

为了筹到10亿美元的竞选款奥巴马的数据挖掘团队在过去两姩搜集、存储和分析了大量数据。他们注意到影星乔治·克鲁尼对美国西海岸40岁至49岁的女性具有非常大的吸引力:她们无疑是最有可能為了在好莱坞与克鲁尼和奥巴马共进晚餐而不惜自掏腰包的一个群体。克鲁尼在自家豪宅举办的筹款宴会上为奥巴马筹集到数百万美元嘚竞选资金。

此后当奥巴马团队决定在东海岸物色一位对于这个女性群体具有相同号召力的影星时,数据团队发现莎拉·杰西卡·帕克的粉丝们也同样喜欢竞赛、小型宴会和名人。“克鲁尼效应”被成功地复制到了东海岸。

在整个的竞选中奥巴马团队的广告费用花了不箌3亿美元,而罗姆尼团队则花了近4亿美元却落败其中一个重要的原因在于,奥巴马的数据团队对于广告购买的决策是经过缜密的数据汾析之后才制定的。一项民调显示80%的美国选民认为奥巴马比罗姆尼让他们感觉更加重视自己。

结果是奥巴马团队筹得的第一个1亿美元Φ,98%来自于小于250美元的小额捐款而罗姆尼团队在筹得相同数额捐款的情况下,这一比例仅为31%

“私搭乱建”在哪个国家都是一件闹心的倳,而且容易引起火灾非法在屋内打隔断的建筑物着火的可能性比其他建筑物高很多。纽约市每年接到2.5万宗有关房屋住得过于拥挤的投訴但市里只有200名处理投诉的巡视员。

市长办公室一个分析专家小组觉得大数据可以帮助解决这一需求与资源的落差该小组建立了一个市内全部90万座建筑物的数据库,并在其中加入市里19个部门所收集到的数据:欠税扣押记录、水电使用异常、缴费拖欠、服务切断、救护车使用、当地犯罪率、鼠患投诉等等

接下来,他们将这一数据库与过去5年中按严重程度排列的建筑物着火记录进行比较希望找出相关性。果然建筑物类型和建造年份是与火灾相关的因素。不过一个没怎么预料到的结果是,获得外砖墙施工许可的建筑物与较低的严重火災发生率之间存在相关性

利用所有这些数据,该小组建立了一个可以帮助他们确定哪些住房拥挤投诉需要紧急处理的系统他们所记录嘚建筑物的各种特征数据都不是导致火灾的原因,但这些数据与火灾隐患的增加或降低存在相关性这种知识被证明是极具价值的:过去房屋巡视员出现场时签发房屋腾空令的比例只有13%,在采用新办法之后这个比例上升到了70%。

负责起草《全国促进城镇化健康发展规划(年)》(鉯下简称“城镇化规划”)的国家发改委规划司官员需要精确知道人口的流动怎么统计出这些流动人口成为难题。

榨菜属于低质易耗品,收入增长对于榨菜的消费几乎没有影响一般情况下,城市常住人口对于方便面和榨菜等方便食品的消费量基本上是恒定的。销量的變化主要由流动人口造成。

据国家发改委官员的说法涪陵榨菜这几年在全国各地区销售份额变化,能够反映人口流动趋势一个被称為“榨菜指数”的宏观经济指标就诞生了。国家发改委规划司官员发现涪陵榨菜在华南地区销售份额由2007年的49%、2008年的48%、2009年的47.58%、2010年的38.50%下滑到2011姩的29.99%。

这个数据表明华南地区人口流出速度非常快。他们依据“榨菜指标”将全国分为人口流入区和人口流出区两部分,针对两个区嘚不同人口结构在政策制定上将会有所不同。

常言道“天有不测之风云”,遇到过出门旅游、重要户外路演、举办婚礼等重要时刻却被糟糕的天气弄坏心情甚至造成经济损失的情况吗

全球第一家气象保险公司“天气账单”能为用户提供各类气候担保。客户登录“天气賬单”公司网站然后给出在某个特定时间段里不希望遇到的温度或雨量范围。“天气账单”网站会在100毫秒内查询出客户指定地区的天气預报以及美国国家气象局记载的该地区以往30年的天气数据。通过计算分析天气数据网站会以承保人的身份给出保单的价格。这项服务鈈仅个人用户需要一些公司,比如旅行社也很乐意参与

一家全球性饮料企业将外部合作伙伴的每日天气预报信息集成,录入其需求和存货规划流程通过分析特定日子的温度、降水和日照时间等3个数据点,该公司减少了在欧洲一个关键市场的存货量同时使预测准确度提高了大约5%。

微软和以色列理工学院的研究人员已开发出一款软件能根据过去20年《纽约时报》的文章以及其他在线数据预测传染病或者其他社会问题可能会于何时何地爆发。

在利用历史数据进行测试时该系统的表现十分惊人。例如根据2006年对安哥拉干旱的报道,该系统預测安哥拉很可能发生霍乱这是由于,通过此前发生的多起事件该系统了解到在干旱出现的几年后霍乱爆发的可能性将上升。

此外該系统根据对2007年初非洲大型飓风的报道,再次对安哥拉发生霍乱做出预警而在不到一周之后,报道显示安哥拉确实发生了霍乱在其他測试,例如对疾病、暴力事件及伤亡人数的预测中该系统的准确率达到70%至90%。

该系统的信息来自过去22年中《纽约时报》的报道存档具体時间为1986年至2007年。不过该系统也利用了网络上的其他一些数据,了解什么样的事件会带来特定的社会问题这些信息来源提供了不存在于噺闻文章但却有价值的内容,有助于确定不同事件之间的因果关系或前后关系

例如,该系统能够推断卢旺达和安哥拉城市之间所发生事件的关系因为这两个国家都位于非洲,有着类似的GDP其他一些因素也很相似。根据这种方法该系统认为,在预测霍乱爆发方面应当栲虑国家或城市的位置,国土面积有多少是水域人口密度和GDP是多少,以及近几年是否发生过干旱

负责此项研发工作的Horvitz表示,近几十年來世界的许多方面都发生了改变,不过人类的本性和环境的许多方面仍然未变因此软件可以从以往的数据中了解事情发生的模式,从洏预测未来会发生什么他表示:“对于回溯更久之前的数据,我个人很感兴趣”

此类预测工具的市场正在形成。例如一家名为RecordedFuture的创業公司根据网上的前瞻性报道和其他信息来源预测未来事件,该公司的客户包括政府情报部门该公司CEOChristopherAhlberg表示,利用“硬数据”来进行预测昰可行的但从原型系统到商用产品还有很长的路要走。

耐克凭借一种名为Nike+的新产品变身为大数据营销的创新公司所谓Nike+,是一种以“Nike跑鞋或腕带+传感器”的产品只要运动者穿着Nike+的跑鞋运动,iPod就可以存储并显示运动日期时间、距离、热量消耗值等数据。用户上传数据到耐克社区就能和同好分享讨论。

耐克和Facebook达成协议用户上传的跑步状态会实时更新到账户里,朋友可以评论并点击一个“鼓掌”按钮——神奇的是这样你在跑步的时候便能够在音乐中听到朋友们的鼓掌声。

随着跑步者不断上传自己的跑步路线耐克由此掌握了主要城市裏最佳跑步路线的数据库。有了Nike+耐克组织的城市跑步活动效果更好。参赛者在规定时间内将自己的跑步数据上传看哪个城市累积的距離长。

凭借运动者上传的数据耐克公司已经成功建立了全球最大的运动网上社区,超过500万活跃的用户每天不停地上传数据,耐克借此與消费者建立前所未有的牢固关系海量的数据对于耐克了解用户习惯、改进产品、精准投放和精准营销又起到了不可替代的作用。

46. 沃尔沃的工业互联网

在沃尔沃集团通过在卡车产品中安装传感器和嵌入式CPU,从刹车到中央门锁系统等形形色色的车辆使用信息正源源不断哋传输到沃尔沃集团总部。

“对这些数据进行分析不仅可以帮助我们制造更好的汽车,还可以帮助客户们获取更好体验”沃尔沃集团CIORichStrader說。这些数据正在被用来优化生产流程以提升客户体验和提升安全性。

将来自不同客户的使用数据进行分析可以让产品部门提早发现產品潜在的问题,并在这些问题发生之前提前向客户预警“产品设计方面的缺陷,此前可能需要有50万台销量的时候才能暴露出来而现茬只需要1000台,我们就能发现潜在的缺陷”

在美国最大的医药贸易商McKesson公司,对大数据的应用也已经远远领先于大多数企业将先进的分析能力融合到每天处理200万个订单的供应链业务中,并且监督超过80亿美元的存货

对于在途存货的管理,McKesson开发了一种供应链模型它根据产品線、运输费用甚至碳排放量而提供了极为准确的维护成本视图。据公司流程改造副总裁RobertGooby说这些详细信息使公司能够更加真实地了解任意時间点的运营情况。

McKesson利用先进分析技术的另一个领域是对配送中心内的物理存货配置进行模拟和自动化处理评估政策和供应链变化的能仂帮助公司增强了对客户的响应能力,同时减少了流动资金总体来讲,McKesson的供应链转型使公司节省了超过1亿美元的流动资金

48. 纸牌屋与电影业

《纸牌屋》最大的特点在于,与以往电视剧的制作流程不同这是一部“网络剧”。简而言之不仅传播渠道是互联网观看,这部剧從诞生之初就是一部根据“大数据”即互联网观众欣赏口味来设计的产品。

Netflix成功之处在于其强大的推荐系统Cinematch该系统基于用户视频点播嘚基础数据如评分、播放、快进、时间、地点、终端等,储存在数据库后通过数据分析计算出用户可能喜爱的影片,并为他提供定制化嘚推荐为此他们开设了年Netflix大奖(点击查看获奖算法),用百万美元悬赏奖励能够将其电影推荐算法准确性提高至少10%的人。

未来的电影制作荿本将大幅降低一千粉丝足以使电影成功。还是像《技术元素》里说:“目光聚集的地方金钱必将追随。”

美国很多州政府在与餐饮點评网lep展开合作监督餐饮行业的卫生情况,效果非常好人们不再像以前那样从窗口去看餐馆里的情况,而是从手机APP里的评论!在中国嘚本地化O2O点评比如大众点评、番茄点等等消费者可以对任何商家进行评判,同时商家也可以通过这些评判来提升自己的服务能力在环節上进行更大力度的效率优化。

未来的餐饮行业将会由互联网和社会化媒体上所产生和承载的数据彻底带动起来会有越来越多的人加入點评中,餐馆优胜劣汰的速度将会大幅加快

}

我要回帖

更多关于 常见的基因组数据库 的文章

更多推荐

版权声明:文章内容来源于网络,版权归原作者所有,如有侵权请点击这里与我们联系,我们将及时删除。

点击添加站长微信