金融大数据模型理念,一切数据皆为信用数据

&">nbsp;   到目前为止,在大数据领域当中的投资已经越来越热,而且做得公司越来越多。有多少公司到底真正使用的是大数据?我相信几乎没有太多。

大数据在美国金融当中最直接的场景,就是所谓的信用评估体系。美国的信用体系评估很简单,就几样东西:债务历史、债务、信用历史时间、相关的其他因素。这些东西全部加起来形成了美国现有的评分体系。

一般来说,如果变量放得太多了,模型处理起来就会比较麻烦。最主要一点它的深度比广度要重要。所以,过去20年的记录,和最近一年当中才有记录,二者之间是不一样的。

另外,关注用户的历史远远多于现在,也许这个人一开始是个屌丝,最近突然发财了,可能他的偿还能力就会有巨大的改变,但是这样的因素有没有体现在这个里面?很多人不知道。怎样把纵向和横向广度上的东西都放进来,这个就会显得相对来说比较重要一点。

大数据到底在金融当中有什么用处?同样一个人在不同的应用和领域当中也不一样。比如今天在这个公司当中呆了20年,不一定说明他是个好员工,很有可 能是他没有能力跳槽。如果你用另外一个角度评判这个人的话,你的评判标准和应用变量应该完全改变。但是非常可惜,没有人从这个角度上衡量一个人。

为什么最终会把风控放到一个这么重要的角度上来?像在中国的P2P公司,6个月或者一年之后,能剩下四分之一都是一个奇迹,很多P2P公司一定会死掉,或者被并购掉。在所有的热潮慢慢退去的时候,风控就会放到最显著的地位上来。

直接征询用户的答案也是很重要的。你可以在一个地方撒谎,你可以在两个地方撒谎,但是如果我大数据采了千千万万的点,很难把千千万万的点在互相不矛盾的情况之下,把它给伪装起来,如果真的能伪装成这样,那就不是一个欺骗的过程,所以很难通过大数据的方法让一个人还能够完全的编造一个不被识破的谎言,很难。

大数据模型理念,一切数据皆为信用数据。所有的那些关键变量,如果单独知道提出来一个,没有太大的用处能够判断出来这个人怎么样,但是如果把所有的 这些细小的因素全部结合在一起,就会发现最后是非常强的指向,可以很准确的判断出来这个人到底在做什么。只看关联不看因果,这是一个非常重要的观点。

同样名字听起来很好,机器学习,咱们都会深刻的体会到,实际上是我们很悲催的学习机器,根本不是机器在学习我们。如何能够更好的跟机器进行沟通,我们给他一个方法,或者给他一个事实,他能够更快的从当中提取出来,更多的是一种互动。

大数据的模型之二,我们认为是数据的来源。即使错误信息也是信息,也体现了一个人的素质。

第三点就是所谓的建模,总而言之,大数据当中对所谓特征的变化,特征的提取和最后所谓独立模型细节的建立,最后模型的整合都跟以前传统统计上的理论有很大的区别。

最后这个是比较有意思的事情,这件事情在中国基本上不存在,但是在美国相对比较麻烦,大数据和相关立法之间的关系。相信中国在今后立法越来越完善也 会碰到这样的问题,信用评估上有些禁区,这些禁区不能碰的。第一性别绝对不可以用的,来决定这个人到底信用值怎么样,这是绝对不可以的。第二年龄,年龄没 有性别那么严重,但是年龄有要求,只能作为一个加分因素,而不能作为减分因素,年龄大家现在很多人也是不用的。第三种族,绝对不能触碰的红线,绝对不能根 据是亚洲人、黑人、白人还是拉丁裔,判定你的信用是好是坏。比如在中国你在街上开车或者在美国,墙上写着字告诉你这个地方不能原地掉头,就是因为太多人在 这个地方原地掉头了,所以才会树个牌子,如果这个地方窄,你不用写,也不会有人原地掉头。禁止使用的这些东西,其实真正最能体现一个人的本质。实际上从我 们模型当中能看得出来,这些不准用的东西,如果用的话,比千千万万的信息加在一起都有用。

大数据另外一个比较奇怪的应用,就是它可以帮助你绕过一些法律上的红线,这并不是打法律的擦边球,而是因为事物的本质就是由这几个因素来决定的,A可以突出C,B又可以突出C,A和B之间必然有相关的。

作者,顾凌云,Turbo Financial Group首席风险。

时间: 2024-12-14 17:59:16

金融大数据模型理念,一切数据皆为信用数据的相关文章

大数据在美国金融:一切数据皆为信用数据

导语:大数据到底在金融当中有什么用处?在美国是怎样被使用的?为什么错误的信息也是有用的?怎样处理大数据中的因果或者关联?大数据与立法之间有什么关系? 作者:顾凌云,Turbo Financial Group首席风险官 摘自:创业邦 目前为止,在大数据领域当中的投资已经越来越热,而且做得公司越来越多.有多少公司到底真正使用的是大数据?我相信几乎没有太多. 大数据在美国金融当中最直接的场景,就是所谓的信用评估体系.美国的信用体系评估很简单,就几样东西:债务历史.债务.信用历史时间.相关的其他因素.这

金融+大数据=?

李克强总理在贵阳出席中国大数据产业峰会暨中国电子商务创新发展峰会时说,大数据等新一代互联网技术深刻改变了世界,也让各国站在科技革命的同一起跑线上.大数据新业态代表的创新理念要和传统行业长期孕育的"工匠精神"相结合,推动虚拟世界与现实世界融合发展,重塑产业链.供应链.价值链,促进新动能蓬勃发展.传统动能焕发生机,打造中国经济"双引擎",实现"双中高". 大数据对金融行业进行了重塑.一方面,相较于传统金融,互联网.云计算.大数据等方面的技术革新,使得

2014中国金融云平台峰会 普元强调“数据治理”才是金融大数据应用的基石

ZDNET至顶网CIO与应用频道 09月19日 北京消息:9月12日,由国内领先的基础软件产品与解决方案提供商普元与计世传媒集团新金融世界联合举办的"2014中国金融云平台峰会"在北京隆重召开.本届峰会以"互联网金融时代的大数据应用"为主题,与会嘉宾涵盖银行.保险.证券.互联网金融等领域的权威专家.公司CIO以及负责信息技术.产品创新的部门负责人,深度探讨了金融业的数据整合.数据挖掘.数据治理.数据平台.数据安全等热点问题,并对互联网金融时代的大数据应用创新与实践进

清华教授谢平:金融大数据基础完备,人工智能应用于金融监管远景宏大

AI金融评论9月29日报道,近年金融科技发展迅猛,对金融监管提出了新要求.由深圳市科学技术协会和深圳市罗湖区人民政府主办,深圳市源创力离岸创新中心和深圳市和信中欧金融科技研究院承办的"中英金融监管科技高峰论坛"于近日举行.本届论坛邀请了国内外顶级学府资深教授.政府机构.金融科技领域权威人士.境内外知名企业参会. 深圳市和信中欧金融科技研究院(以下简称研究院)是一家以金融科技创新.金融科技人才培养和金融科技产业化为宗旨的非营利性研究机构.研究院的建设获得了深圳市罗湖区政府的大力支持.研究

周灏:金融大数据量化信用

本文讲的是周灏:金融大数据量化信用,用于研究宇宙大爆炸的数据分析技术,被周灏创造性地用来研究"谁不还贷"这个金融难题."人们的信用可以通过很多方式评估,我们的作用就是通过大数据分析和机器学习等技术,帮用户把这些零碎的信息数据收集起来并加以分析,让过去没法'量化'的信用受到重视,为用户增信."周灏说. 档案 物理与金融的跨界融合 周灏,北京大学物理学士.莱斯大学物理博士.供职摩根士丹利期间曾构建摩根士丹利与创业融资相关的千亿美元级量化系统.他曾作为第一资本总部资深统计

断篇-金融大数据最佳实践总结篇

一.数据挖掘的价值体现 任何数据分析或者挖掘的项目都不会直接产生经济价值和意义,分析出的数据结果既不能给企业直接带来一个客户,也不能帮助企业卖出一件产品.数据分析的价值体现在于业务部门根据分析结果制定相关的经营策略并贯彻执行. 二.大数据之困-通道 大数据之困-如何打通底层数据存储到上层数据服务的通道问题,讲成为制约大数据发展的关键因素.当越来越多的人意识到大数据的未来在应用的时候,这个问题也就越来越紧迫. 三.大数据金融-行业化运作 大数据金融行业化营销模式才是王道,单独的通过打项目的方式做项

独家《九次方·金融大数据白皮书》全文下载

日前,国内第一份<九次方·金融大数据白皮书>在北京发布.这份报告认为,金融业是大数据的重要产生者,交易.报价.业绩报告.消费者研究报告.官方统计数据公报.调查.新闻报道无一不是数据来源.大数据的发展,也对金融行业的转型.创新也将产生推波助澜的作用. 回复"九次方"下载<九次方·金融大数据白皮书>全文.pdf 白皮书目录如下: 附:<九次方大数据CEO王叁寿:80后创业者的逆袭> 王叁寿,一个80后,主动放弃了大学学业2002年-2005年,在国家图书

“互联网+”下的金融大数据风口解码

文章讲的是"互联网+"下的金融大数据风口解码, 目前,金融行业数据量巨大,是继互联网及运营商之后大数据产生最为庞大的热点行业之一,其中非结构化数据迅速增长,加上金融行业雄厚的资本背景,金融行业已经成了大数据应用的一片沃土.而放眼全球,金融行业也是大数据的应用重镇,根据此前麦肯锡的<大数据的下一个前沿>系列报告,无论从大数据应用综合价值潜力维度,还是平均数据量而言,金融行业大数据的应用综合价值潜力都非常高. 来源:麦肯锡<大数据的下一个前沿:创新.竞争和生产力>报

【独家干货】金融大数据的法律实践

内容摘要 首先,王新锐简要分析了大数据时代用户数据的价值,并就用户个人信息的分类及处理环节进行总结,提出个人.监管者.媒体对此的关注点. 之后,王律师以立法框架.实际案例和业内实践三大部分为线索,通过"2014年3·15曝光鼎盛.大唐红旗等生动案例具体解释前期提到的各项相关法律条文,并分享以"数据脱敏.数据整合.内部隔离"为代表的业内最佳实践经验. 演讲全文: 今天我讲三大部分: 第一,概述.概述是为了让大家知道我们后面讲的东西是为了什么,把大家放在一个语境里,我们要把基本的