- ?
Facebook、谷歌、微软和Twitter联合推出数据传输项目
书白
展开
该项目旨在开发一种新的方式,以在不同平台之间传输数据,而不必下载和重新上传。
微软还敦促其他公司加入这个项目,并称该项目可能是更好竞争的核心。这些公司希望为数据可移植性设定一个行业标准。如果这一计划充分发挥其潜力,可能会对我们使用技术的方式带来重大改变。
这一项目完成后,用户可在不同的平台和设备之间无缝切换移动系统、音乐库和其他应用信息。
目前,这个项目仍处于早期阶段。随着Facebook、Twitter和微软加入到该项目中,这个项目正在取得重大进展。
- ?
干货丨这20个实用小工具,国外数据记者都在用!
Emden
展开
数据的使用对于今天的媒体人来说都是必不可少的,而数据记者更是每天都要和大量数据打交道。除了记者自身的功底和不断实践的积累,其实有一些讨巧的方法可以帮助你在短期内提高这种能力。
下面介绍的20个小工具涉及数据的采集分析、可视化呈现,到最终的发布等,从很多你不曾注意的小细节入手,帮助你更轻松、更高效地完成任务。
1.Raw Graphs
http://rawgraphs.io/
手里有数据但不会做图表?让RawGraphs帮你解决这个问题吧!导入数据、选择想要的模板,只需点击几下就可以生成好看的图表。而且还可以根据你的需要免费下载为svg、png等格式,或者嵌入到网页当中。
2.Ban.jo
http://ban.jo/
为了让突发新闻报道更便捷,Banjo技术收集了全球十亿级的公共服务信号,其中包括急救服务、社交媒体、交通、气象服务以及其他一些数据源。新闻编辑部可以通过这些渠道,直接监控全球的突发新闻。目前有超过1000家媒体组织选择了Banjo来提高突发新闻报道的速度和准确度。
哥本哈根多地发生游行,地图反映了警力集中的地点
3.Hypothes.is
http://hypothes.is/
这是一个谷歌浏览器的扩展程序,可以为人们提供优质的团队工作平台。对于数据记者来说,团队工作是他们的日常状态,因此利用这个平台共享资源、同步进度,可以避免很多不必要的麻烦。
4.Mindful
https://uxplanet.org/introducing-mindful-f424745544e8
不得不说,这个工具大大地提高了我的工作效率:通过浏览器插件的形式,你可以设置近期的任务清单,然后只需一个快捷键就可以调出它。这样反复曝光反复出现,再也不会忘记那些还没完成的DDL了!
5.Pocket Reporter
http://code4sa.org/2016/10/18/pocket-reporter-launch-blog.html
“口袋记者”的应用界面
这是一个便捷的移动端应用,旨在帮助那些业务还不熟练的记者。在报道的整个过程中的每个细节它都会帮你记着,并且提醒你。另外对于那些非专业的“公民记者”来说,也是不错的工具。
6.Trends24
https://trends24.in/
展示一天内各个时段最热的话题
对于各网站的最热话题榜单不满意?试试这个吧,Trends24展示了一天内每个小时的最热话题,另外可以查看某个城市、国家的话题榜,甚至还有全球范围的榜单。
7.ShortHand
https://shorthand/
ShortHand网站截图
一直很羡慕那些×格很高的网站,但是作为一个技术渣,怎么看都觉得自己做的东西太Low。别担心,上ShortHand选择你中意的模板,你也能做出清新脱俗的网页啦。没错,就是那种头图会动、文字和图片滚动速度不同的网页(技术渣属性暴露)……更重要的是,它还可以完美适配各种分辨率的移动端。
8.BuzzSumo
http://buzzsumo/
在该网站搜索“data journalism”后出现的结果
BuzzSumo就像图书馆的数据库,只要输入关键词就可以调出有关的文章。不过这里收录的并不是学术论文和期刊杂志,而是所有在浏览器中能够搜索到的内容,包括文章、图片、信息图表、视频甚至社交网站上用户上传的内容。它会根据Facebook、LinkedIn、Twitter、Pinterest和Google+这几个平台上的分享情况来排序。此外,你还可以自定义时段、语言甚至地域等等,简直是一个移动的互联网数据库。
9.Twitter Audit
https://twitteraudit/
你了解自己Twitter账户的粉丝吗?他们当中有多少是僵尸粉?Twitter Audit可以帮你解答,它会随机选取某个账号的5000个粉丝,然后根据他们发推文数、最近上线的时间,以及他们的影响力,来为有效性打分。这个工具对于粉丝较多的媒体账号来说,是一个了解自己用户的利器,当然你也可以用它“窥探”其他账号的粉丝质量。
10.This by Tinrocket
http://tinrocket/apps/this/
用This by Tinrocket制作的图片
很多人在社交媒体发照片的时候都会加标签,指出照片中每一个细节隐藏的故事。This by Tinrocket就是想帮你完成这个事情,不需要很多浮夸的模板,简洁清新,娓娓道来,这才是图片想要表达的。
11.Momento
https://momentogifs/
这是一个表情包制作神器:通过智能算法,帮你把手机里存的几张相片制作成动图,你可以通过对滤镜、贴纸、播放速度和附加文字的调整,来实现最满意的效果。
12.Typeform
https://typeform/
很多在线调查问卷的有效时间都很短,而且“丑”,用户点进去就没心情做问卷了。Typeform根据人们对问卷的态度和反应,经过重新设计调整,让答题的界面和流程更加富有创意和用户友好性。
13.SoundCite
https://soundcite.knightlab/
只有看视频才会有身临其境的感觉?读文字也同样可以有!奈特实验室做了这样的事情:帮助你在文字中插入音频,阅读到特定的地方时声音响起,带你进入特定的情境。
只需简单的三部:①上传音频,②设定音频播放区间,③选择开始播放的位置。
14.Google Fusion Tables
https://support.google/fusiontables/answer/2571232?hl=en&ref_topic=1652595
这是一个试验性的数据可视化应用,可以帮助你收集、可视化,以及分享数据图表。
15.Datawrapper
https://datawrapper.de/
这是一个开源的数据可视化平台,只需简单的步骤就可以快速创建一些包括饼图、条形图、环形图、地图等在内的交互式图表,另外,用Datawrapper制作的图表还可以直接嵌入网页中。
16.Calcbot
https://tapbots/calcbot/
数据中时常会出现一些我们不熟悉的单位,例如品脱、磅、英里等等,换算时永远也记不住这些单位。让Calcbot来帮助你吧,除了告诉你换算单位、实时汇率等等,友好地界面也会让你不那么烦躁的。
不过目前只支持iOS和Mac,安卓和Windows党还是去百度一下吧…
17.Thsrs
http://ironicsans/thsrs/
对于需要拟写英文内容的人来说,这是一个很实用的工具。输入一个长单词,它就会帮你找到同义的短单词,在想标题和写图表说明的时候很有用。
18. Adobe Post
Adobe Post是一个移动端的在线图表设计应用,大量的模板和设计方案可以帮助你在手机上完成海报的设计制作。
19.Ripl
http://ripl/
Ripl可以让你发布在社交媒体上的内容更吸睛,一张好看的图片加上你喜欢的文字做成封面,再配上音频,最后和正文内容一起放置在布局匀称的模板中,妥妥的文艺+小清新。
20.Bubbli
http://bubb.li/
没有VR设备也想拍全景视频?Bubbli可以帮你制作酷炫的照片,只需在普通拍照模式下多拍几张周围的照片,经过合成后就变成了一张全景照片,看起来像是用鱼眼镜头拍摄出来的。
本文由百度新闻实验室(id:baidunewslab)独家编译,原文载于medium,版权归原作者所有,转载请注明来源。
编译:刘建坤
编辑:邵琦
- ?
曝Twitter贩卖用户数据被抓包
Mariel
展开
IT之家4月29日消息 Facebook滥用用户数据的风波已经渐渐告一段落,但是笼罩在社交媒体用户上的阴云似乎仍未散去。据英国《星期日电讯》报道,Twitter曾在用户不知情的情况下,将用户的数据出售给了剑桥分析(Cambridge Analytica)的学者Aleksandr Kogan,后者正是Facebook用户数据去向的核心人物。
▲《每日电讯》的相关报道
据报道,在2014年12月至2015年4月期间,Kogan曾通过其公司Global Science Research(GSR)向Twitter购买了大量推文、用户名、照片、个人资料图片和位置数据等。他用这些数据创造了分析目标选民的工具。
对此Kogan本人声称,这些数据只是被用于创建“品牌报告”和“调查扩展工具”,并且他没有违反Twitter的政策。
Twitter对此则表示,已经禁止GSR和Cambridge Analytica购买数据或在网站上投放广告,并且此时没有造成私人数据被访问。Twitter上大多数推文都是公开的,但Twitter也有明令禁止公司和组织集体收集推文。
Cambridge Analytica的发言人则声称,该公司从未收到过GSR收集的Twitter数据。
根据报道,Twitter 2017年总销售额的13%来自于数据销售,数额达3.33亿美元。
想看到更多这类内容?去APP商店搜IT之家,天天都有小欢喜。
- ?
全球100款大数据工具汇总
恋恋1983
展开
1、 Talend Open Studio
是第一家针对的数据集成工具市场的ETL(数据的提取Extract、传输Transform、载入Load)开源软件供应商。Talend的下载量已超过200万人次,其开源软件提供了数据整合功能。其用户包括美国国际集团(AIG)、康卡斯特、电子港湾、通用电气、三星、Ticketmaster和韦里逊等企业组织。
2、DYSON
探码科技自主研发的DYSON智能分析系统,可以完整的实现大数据的采集、分析、处理。DYSON智能分析系统专业针对互联网数据抓取、处理、分析,挖掘。可以灵活迅速地抓取网页上散乱分布的信息,并通过强大的处理功能,准确挖掘出所需数据,是目前使用人数最多的网页采集工具.
3、YARN
一种新的Hadoop资源管理器,它是一个通用资源管理系统,可为上层应用提供统一的资源管理和调度,解决了旧MapReduce框架的性能瓶颈。它的基本思想是把资源管理和作业调度/监控的功能分割到单独的守护进程。
4、Mesos
由加州大学伯克利分校的AMPLab首先开发的一款开源群集管理软件,支持Hadoop、ElasticSearch、Spark、Storm 和Kafka等架构。对数据中心而言它就像一个单一的资源池,从物理或虚拟机器中抽离了CPU,内存,存储以及其它计算资源, 很容易建立和有效运行具备容错性和弹性的分布式系统。
5、Datale
由探码科技研发的一款基于Hadoop的大数据平台开发套件,RAI大数据应用平台架构。
6、 Ambari
作为Hadoop生态系统的一部分,提供了基于Web的直观界面,可用于配置、管理和监控Hadoop集群。目前已支持大多数Hadoop组件,包括HDFS、MapReduce、Hive、Pig、 Hbase、Zookeper、Sqoop和Hcatalog等。
7、ZooKeeper
一个分布式的应用程序协调服务,是Hadoop和Hbase的重要组件。它是一个为分布式应用提供一致性服务的工具,让Hadoop集群里面的节点可以彼此协调。ZooKeeper现在已经成为了 Apache的顶级项目,为分布式系统提供了高效可靠且易于使用的协同服务。
8、Thrift
在2007年facebook提交Apache基金会将Thrift作为一个开源项目,对于当时的facebook来说创造thrift是为了解决facebook系统中各系统间大数据量的传输通信以及系统之间语言环境不同需要跨平台的特性。
9、Chukwa
监测大型分布式系统的一个开源数据采集系统。建立在HDFS/MapReduce框架之上并继承了Hadoop的可伸缩性和可靠性,可以收集来自大型分布式系统的数据,用于监控。它还包括灵活而强大的显示工具用于监控、分析结果。
10、Lustre
一个大规模的、安全可靠的、具备高可用性的集群文件系统,它是由SUN公司开发和维护的。该项目主要的目的就是开发下一代的集群文件系统,目前可以支持超过10000个节点,数以PB的数据存储量。
11、HDFS
Hadoop Distributed File System,简称HDFS,是一个分布式文件系统。HDFS是一个高度容错性的系统,适合部署在廉价的机器上。HDFS能提供高吞吐量的数据访问,非常适合大规模数据集上的应用。
12、GlusterFS
一个集群的文件系统,支持PB级的数据量。GlusterFS 通过RDMA和TCP/IP方式将分布到不同服务器上的存储空间汇集成一个大的网络化并行文件系统。
13、Alluxio
前身是Tachyon,是以内存为中心的分布式文件系统,拥有高性能和容错能力,能够为集群框架(如Spark、MapReduce)提供可靠的内存级速度的文件共享服务。
14、Ceph
新一代开源分布式文件系统,主要目标是设计成基于POSIX的没有单点故障的分布式文件系统,提高数据的容错性并实现无缝的复制。
15、PVFS
一个高性能、开源的并行文件系统,主要用于并行计算环境中的应用。PVFS特别为超大数量的客户端和服务器端所设计,它的模块化设计结构可轻松的添加新的硬件和算法支持。
16、QFS
Quantcast File System (QFS) 是一个高性能、容错好、分布式的文件系统,用于开发支持 MapReduce处理或者需要顺序读写大文件的应用。
17、 Logstash
一个应用程序日志、事件的传输、处理、管理和搜索的平台。可以用它来统一对应用程序日志进行收集管理,提供了Web接口用于查询和统计。
18、Scribe
Scribe是Facebook开源的日志收集系统,它能够从各种日志源上收集日志,存储到一个中央存储系统(可以是NFS,分布式文件系统等)上,以便于进行集中统计分析处理。
19、Flume
Cloudera提供的一个高可用的、高可靠的、分布式的海量日志采集、聚合和传输的系统。Flume支持在日志系统中定制各类数据发送方,用于收集数据。同时,Flume支持对数据进行简单处理,并写入各种数据接受方(可定制)。
20、RabbitMQ
一个受欢迎的消息代理系统,通常用于应用程序之间或者程序的不同组件之间通过消息来进行集成。RabbitMQ提供可靠的应用消息发送、易于使用、支持所有主流操作系统、支持大量开发者平台。
21、ActiveMQ
Apache出品,号称“最流行的,最强大”的开源消息集成模式服务器。ActiveMQ特点是速度快,支持多种跨语言的客户端和协议,其企业集成模式和许多先进的功能易于使用,是一个完全支持JMS1.1和J2EE 1.4规范的JMS Provider实现。
22、Kafka
一种高吞吐量的分布式发布订阅消息系统,它可以处理消费者规模网站中的所有动作流数据,目前已成为大数据系统在异步和分布式消息之间的最佳选择。
23、Spark
一个高速、通用大数据计算处理引擎。拥有Hadoop MapReduce所具有的优点,但不同的是Job的中间输出结果可以保存在内存中,从而不再需要读写HDFS,因此Spark能更好地适用于数据挖掘与机器学习等需要迭代的MapReduce的算法。它可以与Hadoop和Apache Mesos一起使用,也可以独立使用。
24、Kinesis
可以构建用于处理或分析流数据的自定义应用程序,来满足特定需求。Amazon Kinesis Streams 每小时可从数十万种来源中连续捕获和存储数TB数据,如网站点击流、财务交易、社交媒体源、IT日志和定位追踪事件。
25、 Hadoop
一个开源框架,适合运行在通用硬件,支持用简单程序模型分布式处理跨集群大数据集,支持从单一服务器到上千服务器的水平scale up。Apache的Hadoop项目已几乎与大数据划上了等号,它不断壮大起来,已成为一个完整的生态系统,拥有众多开源工具面向高度扩展的分布式计算。高效、可靠、可伸缩,能够为你的数据存储项目提供所需的YARN、HDFS和基础架构,并且运行主要的大数据服务和应用程序。
26、Spark Streaming
实现微批处理,目标是很方便的建立可扩展、容错的流应用,支持Java、Scala和Python,和Spark无缝集成。Spark Streaming可以读取数据HDFS,Flume,Kafka,Twitter和ZeroMQ,也可以读取自定义数据。
27、Trident
是对Storm的更高一层的抽象,除了提供一套简单易用的流数据处理API之外,它以batch(一组tuples)为单位进行处理,这样一来,可以使得一些处理更简单和高效。
28、Flink
于今年跻身Apache顶级开源项目,与HDFS完全兼容。Flink提供了基于Java和Scala的API,是一个高效、分布式的通用大数据分析引擎。更主要的是,Flink支持增量迭代计算,使得系统可以快速地处理数据密集型、迭代的任务。
29、Samza
出自于LinkedIn,构建在Kafka之上的分布式流计算框架,是Apache顶级开源项目。可直接利用Kafka和Hadoop YARN提供容错、进程隔离以及安全、资源管理。
30、Storm
Storm是Twitter开源的一个类似于Hadoop的实时数据处理框架。编程模型简单,显著地降低了实时处理的难度,也是当下最人气的流计算框架之一。与其他计算框架相比,Storm最大的优点是毫秒级低延时。
31、Yahoo S4 (Simple Scalable Streaming System)
是一个分布式流计算平台,具备通用、分布式、可扩展的、容错、可插拔等特点。程序员可以很容易地开发处理连续无边界数据流(continuous unbounded streams of data)的应用。它的目标是填补复杂专有系统和面向批处理开源产品之间的空白,并提供高性能计算平台来解决并发处理系统的复杂度。
32、HaLoop
是一个Hadoop MapReduce框架的修改版本,其目标是为了高效支持 迭代,递归数据 分析任务,如PageRank,HITs,K-means,sssp等。
33、Presto
是一个开源的分布式SQL查询引擎,适用于交互式分析查询,可对250PB以上的数据进行快速地交互式分析。Presto的设计和编写是为了解决像Facebook这样规模的商业数据仓库的交互式分析和处理速度的问题。Facebook称Presto的性能比诸如Hive和MapReduce要好上10倍有多。
34、 Drill
于2012年8月份由Apache推出,让用户可以使用基于SQL的查询,查询Hadoop、NoSQL数据库和云存储服务。它能够运行在上千个节点的服务器集群上,且能在几秒内处理PB级或者万亿条的数据记录。它可用于数据挖掘和即席查询,支持一系列广泛的数据库,包括HBase、MongoDB、MapR-DB、HDFS、MapR-FS、亚马逊S3、Azure Blob Storage、谷歌云存储和Swift。
35、Phoenix
是一个Java中间层,可以让开发者在Apache HBase上执行SQL查询。Phoenix完全使用Java编写,并且提供了一个客户端可嵌入的JDBC驱动。Phoenix查询引擎会将SQL查询转换为一个或多个HBase scan,并编排执行以生成标准的JDBC结果集。
36、Pig
是一种编程语言,它简化了Hadoop常见的工作任务。Pig可加载数据、转换数据以及存储最终结果。Pig最大的作用就是为MapReduce框架实现了一套shell脚本 ,类似我们通常熟悉的SQL语句。
37、Hive
是基于Hadoop的一个数据仓库工具,可以将结构化的数据文件映射为一张数据库表,并提供简单的sql查询功能,可以将sql语句转换为MapReduce任务进行运行。 其优点是学习成本低,可以通过类SQL语句快速实现简单的MapReduce统计,不必开发专门的MapReduce应用,十分适合数据仓库的统计分析。
38、SparkSQL
前身是Shark,SparkSQL抛弃原有Shark的代码并汲取了一些优点,如内存列存储(In-Memory Columnar Storage)、Hive兼容性等。由于摆脱了对Hive的依赖性,SparkSQL无论在数据兼容、性能优化、组件扩展方面都得到了极大的方便。
39、Stinger
原来叫Tez,是下一代Hive,由Hortonworks主导开发,运行在YARN上的DAG计算框架。某些测试下,Stinger能提升10倍左右的性能,同时会让Hive支持更多的SQL。
40、Tajo
目的是在HDFS之上构建一个可靠的、支持关系型数据的分布式数据仓库系统,它的重点是提供低延迟、可扩展的ad-hoc查询和在线数据聚集,以及为更传统的ETL提供工具。
41、Impala
Cloudera 声称,基于SQL的Impala数据库是“面向Apache Hadoop的领先的开源分析数据库”。它可以作为一款独立产品来下载,又是Cloudera的商业大数据产品的一部分。Cloudera Impala 可以直接为存储在HDFS或HBase中的Hadoop数据提供快速、交互式的SQL查询。
42、 Elasticsearch
是一个基于Lucene的搜索服务器。它提供了一个分布式、支持多用户的全文搜索引擎,基于RESTful web接口。Elasticsearch是用Java开发的,并作为Apache许可条款下的开放源码发布,是当前流行的企业级搜索引擎。设计用于云计算中,能够达到实时搜索、稳定、可靠、快速、安装使用方便。
43、Solr
基于Apache Lucene,是一种高度可靠、高度扩展的企业搜索平台。知名用户包括eHarmony、西尔斯、StubHub、Zappos、百思买、AT&T、Instagram、Netflix、彭博社和Travelocity。
44、Shark
即Hive on Spark,本质上是通过Hive的HQL解析,把HQL翻译成Spark上的RDD操作,然后通过Hive的metadata获取数据库里的表信息,实际HDFS上的数据和文件,会由Shark获取并放到Spark上运算。Shark的特点就是快,完全兼容Hive,且可以在shell模式下使用rdd2sql()这样的API,把HQL得到的结果集,继续在scala环境下运算,支持自己编写简单的机器学习或简单分析处理函数,对HQL结果进一步分析计算。
45、Lucene
基于Java的Lucene可以非常迅速地执行全文搜索。据官方网站声称,它在现代硬件上每小时能够检索超过150GB的数据,它拥有强大而高效的搜索算法。
46、Terracotta
声称其BigMemory技术是“世界上首屈一指的内存中数据管理平台”,支持简单、可扩展、实时消息,声称在190个国家拥有210万开发人员,全球1000家企业部署了其软件。
47、 Ignite
是一种高性能、整合式、分布式的内存中平台,可用于对大规模数据集执行实时计算和处理,速度比传统的基于磁盘的技术或闪存技术高出好几个数量级。该平台包括数据网格、计算网格、服务网格、流媒体、Hadoop加速、高级集群、文件系统、消息传递、事件和数据结构等功能。
48、GemFire
Pivotal宣布它将开放其大数据套件关键组件的源代码,其中包括GemFire内存中NoSQL数据库。它已向Apache软件基金会递交了一项提案,以便在“Geode”的名下管理GemFire数据库的核心引擎。
49、 GridGain
由Apache Ignite驱动的GridGrain提供内存中数据结构,用于迅速处理大数据,还提供基于同一技术的Hadoop加速器。
50、MongoDB
是一个基于分布式文件存储的数据库。由C++...
- ?
Twitter将部分数据存储及计算任务转移至Google Cloud
千柔
展开
5月4日消息,Twitter日前宣布将一些不常用数据的存储及部分Hadoop集群转移至Google Cloud Platform。于Google Cloud而言,这算是一个不小的成绩,Twitter至少是社交媒体领域标杆的企业。
Twitter首席技术官Parag Agrawal本周四在博客中写道,该公司正将其长期的、很少使用的数据,也就是所谓的冷数据存储,用在谷歌云服务之上。
Twitter还使用了Hadoop集群,这是一个流行的开源系统,可以将远程服务器组装成一台强大的计算机。Parag Agrawal说,Twitter还将在谷歌云服务上运行一些Hadoop计算任务。
“Twitter的工程策略与其平台的需求以及谷歌云服务在全球范围内提供的服务是一致的。”Google Cloud CTO Brian Stevens在一份声明中说:“谷歌云平台的数据解决方案和可信基础设施将为Twitter提供其平台所需的技术灵活性和一致性,我们期待与他们的团队进行持续的技术合作。”
此次合作是谷歌云首席执行官黛安格林(Diane Greene)取得进展的一个小信号,她一直试图从大公司赢得更多业务,并将它们从云领导厂商亚马逊AWS和微软Azure那里吸引过来。
2017年第四季度,Google Cloud业务季度营收首次突破10亿美元。在刚刚发布的2018年第一季业绩电话会议上,Google CEO Sundar Pichai表示,该业务延续了去年的增长势头。
Google Cloud还在签约更多大型合作伙伴,安全能力、分析能力以及G-Suite都在帮助Google Cloud获得更多客户。也就是说,安全、机器学习、AI等已经帮助Google Cloud在竞争中形成了差异化。
2018年第一季度,Google员工增长4940名,其中大部分是云业务部分的技术和销售人员。Google Cloud全球云计算可用区域将达到20个。最近,谷歌在加拿大、日本、荷兰和沙特阿拉伯为其云服务推出了新的区域。
今年1月,苹果公司更新了iOS安全手册,其中提到目前苹果公司正使用Google云平台存储iCloud数据。
市场研究机构Synergy Research的数据显示,全球云基础设施市场,Google Cloud的市场份额约为7%,排在亚马逊AWS和微软Azure之后。
- ?
Twitter数据保护官:隐私是一项基本权利 而不是特权
小凡
展开
腾讯科技讯 美国参议院商务委员会主席约翰·图恩(John Thune)于美国东部时间周三10时(北京时间26日22时)召开主题为“审查保护消费者数据隐私措施”的听证会,重点审查顶级科技和通信公司的隐私政策,消费者数据隐私的现状,并为成员提供机会讨论更有效地保护隐私的可行方案。
Twitter数据保护官达米安·基兰出席听证会,并表示:“我们相信隐私是一项基本权利,而不是特权。Twitter希望能够让所有使用我们服务的个人就他们与我们共享的信息做出最好的决定。这是至关重要的,因为我们居住的数字世界在不断地发展变化,并以重要的方式影响着我们的生活。现在是科技行业、民间社会和政府部门共同努力开发一个强有力的隐私框架的时候了,这个框架应该通过确保透明度和问责制,同时保持创新自由来保护个人权利。我们随时准备协助委员会继续探讨各种办法,以确保美国人的隐私得到有效保护。”
以下为Twitter数据保护官达米安·基兰(Damien Kieran)的证词:
尊敬的图恩主席、纳尔逊副主席和委员会成员们:
感谢各位今天给我机会出席委员会会议,讨论消费者数据隐私这一重要问题。
Twitter的目的是为公众对话服务。我们通过关注使用我们服务的人来服务于全球受众,我们在每一步行动中都把他们放在第一位。全世界的人都把Twitter当作一个“城市广场”,来公开、透明并自由地交换意见。我们必须是一个值得信任和健康的地方,以便继续通过这种方式交流思想和信息。
为了确保这种信任,使用我们服务的用户隐私对Twitter来说至关重要。我们认为隐私是一项基本权利,而不是特权。隐私是Twitter骨子里的一部分。自从十多年前创建Twitter以来,我们为人们提供了一系列的方式来控制Twitter体验,从创建假名账户到让用户控制谁可以看到他们的推文,此外还有各种细致入微的隐私控制功能。这种经过深思熟虑的设计让全世界的人都可以使用Twitter来保护自己的隐私。
同样的理念指导我们如何保护人们与Twitter共享的数据。Twitter授权用户就他们与我们共享的数据做出明智的决定。对于自己的何种数据被收集、如何被使用、何时被共享,我们相信每个人都应该知道,并且能够有效控制。我们认为,现在是时候让整个行业、民间社会和政府共同努力,建立一个强有力的隐私框架。这个框架应该通过确保透明度和问责制来,同时保持创新自由来保护个人权利。
本证词提供了关于Twitter服务的信息,包括(1)人们如何在Twitter上交流;(2)我们收到的信息;(3)概述Twitter如何使用数据以及Twitter为个人管理数据提供的工具。
一、人们在Twitter上的交流
Twitter的构思和设计都基于成为一个公众对话的平台。这是该服务的关键特性,也是Twitter有别于许多其他互联网公司的地方。当一个人创建了一个Twitter帐户并开始使用Twitter时,他或她的推文是公开的。
1.无论是否拥有Twitter账户,世界各地的人都可以查看和搜索推文。相应地,当一个人关注另一个Twitter帐户或喜欢另一条推文时,其他人可以看到他所关注的帐户和他喜欢的推文。人们理解Twitter的默认公共性质,来到Twitter就期望看到并参与他们感兴趣的公共对话。因此,当个人发出一条推文时,其控制着所共享的内容,其中也包括内容的私密性。这就是Twitter的设计方式,也是该平台向客户所提供的吸引力和价值主张的主要组成部分。
虽然大多数人来Twitter是为了加入公众对话,Twitter也提供了一些非公开交流的方式。例如,个人可以通过改变他们的设置来保护自己的帐户。如果一个人对自己的帐户设置了保护,他们的推文默认不会公开。相反,来自受保护账户的推文只对个人准许的关注者可见,不会出现在谷歌搜索等第三方搜索引擎中。此外,人们还可以通过Twitter平台的直接信息功能进行交流,而不用公开发推文。
二、关于Twitter平台的信息接收
虽然人们在Twitter上分享的信息通常是公开的,但Twitter平台也能够接收非公开的个人信息。例如,创建Twitter帐户的人必须向平台提供他或她的电子邮件地址或电话号码。Twitter还将接收标准的日志信息,比如正在使用的设备和IP地址。使用该服务的人也可以选择与Twitter共享其他信息,比如说他们的地址簿联系人,以便通过Twitter与他们认识的人联系,帮助其他人找到并联系他们,或者是更好地向他们和其他人推荐推文。
此外,与几乎所有其他在线平台一样,Twitter使用cookie和其他类似技术(比如像素或本地化存储)来运行其服务,并为平台上的用户提供更好、更快、更安全的体验。cookie是网站在用户个人浏览网页时在电脑上生成的小文件。像许多网站一样,Twitter使用cookie来发现人们如何使用这些服务,并使其能够更好地运作。Twitter还使用cookie为用户提供更相关的内容,并提供有针对性的广告服务。Twitter为用户个人提供了额外的控制权,以决定他们的数据是否可用于这些目的。
为了向人们展示最有趣和最相关的内容,Twitter可能会根据用户在平台上的活动和其他信息来推断个人信息。这包括人们可能感兴趣的话题,一个人的年龄,一个人说什么语言,以及一个账户的内容是否会引起平台上其他人的兴趣。例如,Twitter可能根据个人关注的账号来推断出某人是篮球迷,并推送与美国国家篮球协会相关的内容。这种推断帮助Twitter为用户提供更好的服务,并个性化Twitter显示的内容,其中也包括广告。
2.Twitter使用它接收到的数据以各种方式提供、衡量和改进用户服务,其中包括:保护服务;身份验证和安全;记忆偏好;改进分析和研究,包括Twitter广告以及Twitter按钮和小部件;个性化Twitter服务,为用户提供诸如个性化的趋势、故事、广告等更相关的内容;协助投放广告,衡量广告表现,并使其更具相关性。
三、透明度和控制
Twitter认为,个人用户应该了解并有效控制关于他们的哪些数据被收集、如何被使用以及何时被共享等平台行为。Twitter一直致力于提高数据收集和使用的透明度。Twitter不断设计和改进其服务,以便于用户能够控制通过服务所共享的个人数据。使用我们服务的人有工具来帮助他们控制数据。例如,如果一个人注册了一个帐户,通过他们的帐户设置,他们可以访问、更正、删除或修改与他们帐户相关的个人数据。
A.数据透明度
Twitter最近更新了隐私政策,包括标注、图形和动画等多种表现形式,旨在让人们更好地理解我们接收何种数据、如何使用数据以及何时共享数据。
Twitter还提供了一个名为“您的Twitter数据(Your Twitter Data)”的工具集。“您的Twitter数据”工具集提供了个人对Twitter存储数据类型的可访问权限,其中包括用户名、电子邮件地址和与帐户创建详细信息相关联的电话号码。如果用户之前已经提供给Twitter平台,那么个人的生日和位置也会显示在工具中。
使用该工具集的个人还可以查看和修改Twitter所推断的关于帐户和设备的某些信息,如性别、年龄范围、语言和兴趣。Twitter上的用户可以查看推断信息、采纳个性化信息的广告商,以及来自外部广告合作伙伴的人口和兴趣数据。“您的Twitter数据”工具还允许拥有Twitter帐户的用户从Twitter下载相关数据的副本。我们最近更新了“您的Twitter数据”工具的下载功能,以包含更多的其他信息。自2018年5月25日更新以来,我们已经看到全世界大约有586000人使用该工具下载了560TB的数据。
对于那些没有Twitter账户的人,或者那些注销了账户的人,可以使用这个工具集的特定版本。
B.管理数据的工具
当个人在Twitter上登录自己的账户,他们立即获得一系列工具和帐户设置,从而能够访问、更正、删除或修改提供给Twitter并与账户相关联的个人数据,其中包括公共或私人设置,市场偏好,以及可以访问他们账户的应用程序。这些设置可以更好地个性化用户对Twitter的使用,并让用户有机会对Twitter是否收集特定数据、如何使用数据以及如何共享数据做出明智的选择。
例如,个人可以更改其Twitter帐户的个性化设置和数据设置,其中包括:
●是否向Twitter平台内外的个人展示基于兴趣的广告;
●Twitter如何个性化个人在不同设备上的用户体验;
●Twitter是否收集和使用个人的精确位置;
●Twitter是否根据个人曾经去过的地方个性化用户体验;
和
●Twitter是否跟踪个人通过Twitter内容所浏览的网站。
Twitter上的个人可以禁用所有个性化设置和数据设置功能,只需在屏幕顶部显著位置进行一次操作即可。
平台上的用户也可以注销他们的账户。已停用的Twitter帐户,包括其显示名称、用户名、推文和公共配置信息在Twitter、Twitter (iOS)和Twitter (Android)上都不再可见。
C.第三方访问Twitter数据
为了在Twitter上尽可能广泛地共享公共内容,我们通过应用程序编程接口(API)向公司、开发人员和其他客户提供通过编程方式访问公共Twitter数据的方法。Twitter只会根据个人指示或个人设置来披露个人数据。此外,只有为保护任何人的安全,保护我们平台的安全或完整性,并解决欺诈、安全或技术问题时,Twitter才会披露个人的私人信息。我们亦会在合理需要的情况下披露资料,以符合相关法律要求。
1.开发者和合作伙伴
Twitter 的API提供了对公开Twitter数据的广泛访问。Twitter还允许平台上的个人通过API管理自己的非公开Twitter信息,并将这些信息提供给已授权的开发人员。
新的企业和高级API客户以及数据合作伙伴在被授予访问Twitter数据的权限之前会经过审核流程。该过程会审查该公司的历史、数据可能的用例、隐私和安全考量,旨在防止滥用数据。Twitter经常拒绝不符合我们规则的用例,我们经常要求客户修改和重新提交应用程序,以确保它们符合我们的策略。
此外,我们的开发策略对所有开发人员(企业合作伙伴以及我们的高级API客户)如何使用Twitter数据设置了一些限制。如果有正当理由,Twitter将对违反开发者协议和政策或Twitter规则的应用程序采取强制措施。
2.执法
在必须要向执法部门披露私人个人数据的有限情况下,Twitter这样做只是为了响应适当的法律程序,比如传票、法院命令以及其他有效的法律程序,或者是响应有效的紧急请求。
最后,我们相信隐私是一项基本权利,而不是特权。Twitter希望能够让所有使用我们服务的个人就他们与我们共享的信息做出最好的决定。这是至关重要的,因为我们居住的数字世界在不断地发展变化,并以重要的方式影响着我们的生活。现在是科技行业、民间社会和政府部门共同努力开发一个强有力的隐私框架的时候了,这个框架应该通过确保透明度和问责制,同时保持创新自由来保护个人权利。我们随时准备协助委员会继续探讨各种办法,以确保美国人的隐私得到有效保护。
- ?
Twitter即将推出新隐私政策!用户的数据原来还能这样用?
夏青
展开
最近关于Facebook的焦点很多,因此很容易忘记收集数据的所有其他科技公司。
Twitter就是其中之一,如果你想知道它是如何收集、使用和分享你的数据的,那么恭喜你,该公司在周二的时候透露了最新的隐私政策。
目前Twitter的这一政策出现在众多科技公司的隐私政策更新中,这都是为了响应欧盟的一套新规定。 全球各地的公司都在更新其政策,以遵守“通用数据保护条例”即GDPR。 该规定为欧洲人提供访问和删除Twitter等公司收集的有关数据的新权利,并将在5月25日生效。巧合的是,Twitter的新隐私政策也将在那时生效。
据了解,该政策不仅内容丰富,还适用于世界各地的用户。但是内容却长达4900字,要一下子搞明白可能不太容易,下面, 我们来为大家剖析一下它主要解决的问题。
Twitter是公开的,那么我们为什么要谈论隐私?
当然,使用Twitter有点像站在街角用扩音器说话。当我们在谈论一种服务的隐私问题时,而这种服务又是公开传播您的的观点、思想和愚蠢文化基因时,可能会有点混乱。但是,Twitter公司对你的了解实际上比你在其网站上公开发布的内容要更多。
就像Facebook一样,不仅可以从你的设备上收集信息,还可以跟踪到你从手机到笔记本电脑的信息。此外,它还会从你访问的网站去收集信息,无论你是否登录了该服务。
更重要的是,它还会收集你的朋友、家人、熟人、业务联系人或者任何可能在你的联系人中拥有你的电子邮件地址或电话号码的人的联系信息。当这些人将他们的联系人上传到Twitter时就会发生这种情况(Facebook也这样做。)
而这些都为Twitter提供了丰富的网页浏览习惯、位置和兴趣等资料。
Twitter如何使用我的信息?
Twitter使用这些信息主要是向你展示它认为会吸引你兴趣的广告。
Twitter在其新政策中表示:
“我们使用本隐私政策中描述的信息来帮助我们的广告与你相匹配,从而衡量其有效性,并帮助识别你的设备,以便在Twitter上投放广告。”
这是Twitter为了使自己对用户有价值而提供的个性化服务分。Twitter的政策已经连续使用“相关”一词六次,主要用于引用广告以及你可能希望在时间线上看到的推文或者是你希望在Twitter上关注的人。
为了使这些广告真正有效,Twitter表示它会根据收集的数据推断你的某些事情,包括年龄、语言和性别。
Twitter还利用它来检测欺诈行为并阻止其平台上的其他类型的滥用行为,并向你展示它所发现的相关事情。
我有什么发言权吗?
Twitter对此有所预见:你受隐私政策的约束。
“在5月25日之后继续使用我们的服务,则代表你同意新的隐私政策。”该政策会在应用页面顶部的粗体横幅中列明。
你也可以更改帐户中的各种隐私设置,并且选择你使用Twitter数据的多种方式。 包括基于兴趣的广告,以及让Twitter通过设备跟踪并使用你的位置来定制广告。
要控制这些设置,请转到您的帐户设置,然后选择左侧菜单中的“隐私和安全”。 然后向下滚动到“个性化和数据”并选择编辑。 Twitter将向你显示一个页面,你可以在其中决定你希望使用哪些个性化技术(如果您想用的话)。
Twitter会为各地的用户提供GDPR保护吗?
据Twitter称,新的隐私政策赋予每个人类似的权利。
“我们的隐私政策是向所有用户解释我们隐私惯例的专门文件,适用于世界各地的用户。”
Twitter发言人在一封电子邮件中表示。
其新政策似乎包括GDPR提供的新权利,比如数据的可移植性和可删除。数据可移植性是指用户可以要求提供服务的公司提供自己的所有数据,也可以请求提供服务的公司删除自己相关数据的权利。
新政策包括以上两者的操作说明。尽管去年7月份生效的旧政策没有提及数据可移植性或数据删除的术语,但它已经提供了下载数据并请求修改或删除数据的方法。
Forrester业务分析师法蒂姆·卡蒂布洛Fatemeh Khatibloo表示,尽管在GDPR生效后任何地区的用户都提出这些要求,但只有欧盟居民才会拥有法规背后的法律效力。
本文由罗超频道翻译自【https://cnet/news/twitter-privacy-policy-heres-what-we-do-with-your-data/】
原文作者:【LAURA HAUTALA】
- ?
Twitter要让你更好地知道数据用在哪了
丁水之
展开
IT之家4月25日消息 Facebook泄密门作一个起点,引发了一场关于用户隐私数据的“大爆炸”。同时这,一系列事件也唤起了各大社交平台对用户数据的重视。近日Twitter也发表公开声明,表示将对其服务条款进行更新,在新的服务政策中,用户可以对自己的个人数据被怎么用了更加了解。
Twitter在声明中承诺,应对下个月生效的新数据保护法,Twitter将通过本次更新,更加开放用户对个人数据的掌控。新的服务条款将从5月25日起执行。
这些改进具体侧重于:
用户对个人数据的掌控用户对Twitter即时地、大范围地使用用户数据的了解(包括在开发工具中使用)用户对Twitter与合作伙伴间如何分享数据的透明性和掌控能力用户对Twitter如何分享个人数据的了解,以遵循法律、符合公共利益并免受伤害,同时保证Twitter对所有人都是安全、惬意的。
Facebook收集个人数据引发的争议催生出了这样的见解:网络广告行业可能对我们的隐私和身心健康有害。公众对个人隐私和数据变得更为重视,他们担心在自己的信息被贩卖给广告商们的过程中,自己的数据安全和隐私会受到损害。
想看到更多这类内容?去APP商店搜IT之家,天天都有小欢喜。
twitter数据采集
-
1、只需3秒快速实现求和
-
2、如何快速填充序号
-
3、如何自动填充序号(公式法)
-
4、数据条的神奇应用
-
5、多文本快速合并
-
6、查找与替换的不同玩法
-
7、快速定位到指定区域
-
8、数据排序、工资条制作
-
9、快速筛选(模糊、精确筛选)
-
10、快速插入空行
-
11、快速删除空行
-
12.快速跳转到天涯海角
-
13、.同时查看两个Excel文件
-
14、用条件格式扮靓报表
-
15、一键插入Excel图表
-
16、批量处理行高、列宽
-
17、利用拆分功能查看数据
-
18、批量录入相同内容
-
19、工作表快速跳转
-
20、批量录入表格模板(精品课程)
-
21、Excel函数与公式的应用、公式循环引用的查找
-
22、IF函数单条件判断同比增长
-
23、用sum函数 格式相同,连续多表数据汇总
-
24、excel快捷键
-
25、VLOOKUP函数——根据销售员匹配销售额
-
26、统计各部门销售总额
-
27、统计指定条件个数
-
28、怎样输入当前日期和时间、星期数
-
29、销售业绩排名
-
30、Sumproduct函数-万能函数(销售额汇总求和)
-
31、根据销售员,地区,商品名称汇总
-
32、批量替换PPT字体
-
33、给销售额数据批量添加万元单位
-
34、一秒快速核对两列数据
-
35、快速定位到指定单元格或区域
-
36、快速制作双行标题工资条
-
37、给你的表格做个瘦身
-
38、快速打开常用的Excel文件
-
39、快速打开多个Excel文件
-
40、利用创建组—快速隐藏/展开多列数据
-
41、快速制作下拉菜单
-
42、复制粘贴表格,如何保留数据源列宽格式一致?
-
43、两列数据位置互换
-
44、1秒钟扮靓报表——如何实现表格隔行换色
-
45、快速删除重复记录——保留唯一值
-
46、快速向下填充、向右填充,文本或公式
-
47、给Excel文件添加密码
-
48、插入带图片的批注
-
49、输入公式后不计算?
-
50、如何设置单元格缩进
-
51、快速解决Excel表格总显示货币格式
-
52、批量添加万元单位
-
53、你会四舍五入么?
-
54、用RAND函数机选彩票
-
55、冻结首行你会么?
-
56、超链接的高级应用
-
57、IFERROR函数-屏蔽错误值
-
58、批量填充颜色
-
59、录入数据
-
60、快速输入工号
-
61、快速行列转置
-
62、自定义缩放界面
-
63、多个单元格同时输入
-
64、如何计算立方米?
-
65、快速制作双行标题工资条
-
66、输入带方框的√和×
-
67、快速将姓名对齐
-
68、快速输入性别
-
69、按单位职务排序
-
70、自动计算合同到期日期
-
71、计算时间间隔
-
72、日期和时间的拆分
-
73、快速处理不规范的日期格式
-
74、快速填充合并单元格
-
75、效率加倍的快捷键
-
76、快速复制表格和对象
-
77、快速创建工作表副本
-
78、快速复制序列号
-
79、快速显示公式
-
80、多个单元格同时输入
-
81、快速调整显示比例
-
82、快速自动填充
-
83、快速填充(Ctrl+E)
-
84、Ctrl与数字键结合
-
85、快速将多列数据整理为1列
-
86、快速将1列数据拆分为多列
-
87、快速定位公式
-
88、快速录入数据
-
89、快速累计求和
-
90、身份证号码显示为0怎么办?
-
91、快速制作斜线表头
-
92、文本竖向显示
-
93、神奇的监视窗口
-
94、不一样的格式刷
-
95、快速美化图表
-
96、快速生成当前日期
-
97、快速找出循环引用
-
98、快速提取信息
-
99、二维表快速转换为一维表
-
100、快速多表合并