智能公交一卡通极大地方便了人们的出行,研究人员又在开发它的新功能:抓小偷!他们在北京测试了这种大数据挖掘方法,结果成功地“验证”了近93%的小偷。

4e4a20a4462309f74556fdb1700e0cf3d7cad65c

美国罗格斯大学熊辉教授等人日前在旧金山举行的知识发现和数据挖掘大会上报告了这一成果。其原理是:绝大多数乘客乘坐公交车或地铁出行时,会选择最优出行方案,要么用时最短,要么换乘次数最少;但有极少数人的乘车路线很奇怪,比如会绕行一大圈或者突然改变乘车路线,没有什么规律可言,如果某人的异常行为足够多,那么他有可能是小偷。

道理看似简单,但要找到真正的小偷难度不小。研究人员指出,自动售检票系统收集了数百万名乘客的海量出行记录,其中只有很少部分人可能是小偷,在如此大规模的数据中识别出这么一小群人无异于大海捞针。

为此,研究人员通过两个步骤分析了北京市2014年4月至6月间约16亿次公交卡刷卡数据记录,共涉及约600万名乘客。第一步,他们把北京划分为居住、工作、教育、购物、娱乐、医疗等多个小功能区块,建立起包括896条公交路线、近4.5万个公交车站与18条地铁路线、320个地铁站的公共交通网络数据集,通过数据建模从庞大的公交卡记录中过滤掉普通乘客;第二步,结合从警方报告和微博上收集到的失窃信息,通过机器学习算法从异常出行信息中挖掘出潜在的小偷。

结果显示,如果以后来确认的小偷验证,按上述方法可以归为“行为异常”的准确率高达92.7%。但是反过来的精度有点低:每筛选出14个“行为异常”的可疑者,只有1人后来被确认为小偷。

尽管如此,熊辉认为,使用闭路摄像头监控少部分可疑者远比追踪数以百万计的乘客更高效。但是如果小偷频繁换用公交卡呢?他说,就算换卡也有办法,比如小偷经常团伙活动,这也是一个明显的特征。

也有专家对这种技术表示质疑。英国《经济学人》杂志援引伦敦交通局首席技术官沙希·维尔马的话说,从伦敦的有关记录看,大量普通乘客出行时也会有各种“怪异、精彩、复杂”的行为,要从海量乘客中筛选出极少数罪犯不像听起来那么容易。

关注中国IDC圈官方微信:idc-quan 我们将定期推送IDC产业最新资讯

查看心情排行你看到此篇文章的感受是:


  • 支持

  • 高兴

  • 震惊

  • 愤怒

  • 无聊

  • 无奈

  • 谎言

  • 枪稿

  • 不解

  • 标题党
2023-08-24 09:38:00
大数据资讯 关注县域数据能力建设,抢占产数业务发展先机
2023年《数字中国建设整体布局规划》正式发布,数据能力已成为我国区域发展的底座和创新引擎。 <详情>
2023-03-30 11:15:07
云资讯 分布式时代已至,数据如何更有价值?
无论是连通各大集群内大型超大型数据中心,还是连接边缘侧小型、边缘数据中心,分布式云计算都已成为这张算力网络最重要的支撑。在此背景下,云计算步入分布式时代。 <详情>
2023-03-01 19:27:00
市场情报 FlagOpen大模型技术开源体系,开启大模型时代“新Linux”生态
大数据+大算力+强算法=大模型”是当前人工智能发展的主要技术路径。语言大模型ChatGPT成为现象级应用,人工智能进入普及应用的新时期。 <详情>
2023-01-09 09:36:46
大数据资讯 我国互联网广告数据匿名实施服务正式上线
《指南》形成的“技术保障、评估规制、过程控制”的互信制衡机制,适用于各类互联网广告业务,包括广告投放、程序化交易、广告监测等应用场景下的数据匿名化处理。 <详情>
2022-12-30 10:10:19
大数据资讯 中国移动磐维数据库正式发布
未来,随着数据库功能和稳定性等进一步增强,磐维数据库将在中国移动内外部的广泛应用中积累更多复杂业务场景实践经验,进一步提升数据库产品的核心技术能力,助力数智化转 <详情>