Skip to content

文章档案

全部文章按时间归档 · 可用分类 / 月份 / 关键词筛选,或切到日历视图按日期浏览

2026年9月3 篇

QIAN数据:门控遗漏定律与设计效应DEFF——定时任务跑了998次只失败4次,就敢说系统可靠吗?定时任务跑了998次只失败4次,验证到底要做多少次才够?门控遗漏定律与设计效应DEFF拆解
统计
Agent风险评分——12个维度怎么算成一张分数表Agent风险评分怎么做:12维指标、熵权与CRITIC权重对比、分数校准与阈值定义、PSI漂移监控
LLM
多Agent合谋——当一个AI骗另一个AI时,反欺诈怎么接多个AI Agent会不会合谋骗过反欺诈?合谋让群体影响率从17%升到41%,附共现矩阵与模块度检测代码
LLM

2026年8月16 篇

消费贷贴息潮——利率降下来,风险升上去?消费贷贴息潮:利率降下来风险为什么升上去?逆向选择与风险定价的数学关系
风控
KS 与 AUC——单点 vs 积分,为什么 AUC 相同,KS 能差 40%KS是单点、AUC是积分:两者存在精确数学关系,AUC相同时KS可能差40%。选模型看AUC,定阈值看KS
风控
交易图上的洗钱迷宫——非法交易的邻居,99.8%也是非法Elliptic 20.4万交易节点实测:非法交易的邻居99.8%也非法。用同配性与社区发现揪出洗钱团伙
风控
欺诈率0.1%的建模战争——99.9%准确率的模型为什么没用?欺诈率0.17%时,99.92%准确率只比全部放行多抓0.09个百分点。贝叶斯最优阈值与PR曲线的正确用法
风控
违约时间才是真信号——Cox 生存分析与竞争风险违约时间才是真信号:Cox比例风险模型与竞争风险,风险比HR怎么算、Aalen-Johansen如何估计
风控
Vintage 分析——批次×账龄:暴露速度、违约高峰与客群分层Vintage分析怎么做:账龄、生存曲线与风险函数,右删失数据下如何正确比较不同批次的资产质量
风控
概率校准——什么时候是白干,什么时候救命同一个逻辑回归换个切分方式:随机切分ECE为0.0009天然校准,时间切分0.0904崩溃,错误校准越校越糟
风控
评分卡单调性——WOE 排序与回归系数,谁在说谎评分卡单调性为什么必须检查:WOE与逻辑回归共线性怎么导致翻转,用SymPy做单调约束求解
风控
策略规则里的死分支——阈值设得再严,客户根本不存在规则引擎里的死分支:实测226万笔贷款,证明有些规则从上线起就永远不可能命中,附区间代数检测法
风控
风控策略规则的代理变量冗余——九条规则三个维度,最优只需三条两条策略规则看着不同,其实在拦同一批人:代理变量与策略冗余检测,用独有命中找最优组合
风控
全球平均只升了1.2°C,为什么热浪一年比一年猛平均气温只升1.2度,极端高温为什么涨了近3倍?146年NASA数据揭示均值平移如何放大尾部风险
统计
风控策略规则里的冗余——布尔代数怎么把规则迷宫变简单风控规则能不能化简?用布尔代数做逻辑等价变换,删掉冗余条件同时不改变判定结果
风控
AI Agent越来越多,但谁来给Agent的风险分类——一个实用治理框架AI Agent越来越多,谁来管?ARC框架把Agent拆成12个可评分维度,输出三级治理动作
LLM
评分卡地形图——模型眼里的安全平原,现实里的危险山脊把评分卡画成风险地形图:用PDP部分依赖找模型失准区,交叉变量裂缝与策略落地评估
风控
James-Stein定理——为什么把估计往均值拉一点,整体反而更准James-Stein定理:同时估计多个参数时向均值收缩,总误差反而更小。50个分组验证改善52.5%
统计
KS下降了,真的是模型出了问题吗——一个反事实诊断框架KS下降不等于模型退化:四层反事实诊断把KS下滑归因到抽样、构成、协变量与真实漂移,避免误回退
风控

2026年7月17 篇

L1/L2正则化的数学解读——从Ridge到Lasso的收缩之路L1与L2正则化怎么防过拟合:Lasso做特征选择、Ridge等比例收缩,含闭式解推导与Lasso路径图
统计
Z-score预警——A股科技股拥挤踩踏的量化信号拆解科创50六月涨26%七月跌22%:用实时数据拆解拥挤踩踏的形成与崩塌,Z-score信号怎么提前预警
统计
贝叶斯更新——失败只是更新了先验,不是你的终局贝叶斯更新的实战解读:先验、似然、后验怎么算,一次失败只是更新先验而不是终局,附风控场景代码
统计
马尔可夫链——过去不决定你,只有现在这一步说了算马尔可夫链入门:状态转移矩阵怎么算,无记忆性意味着什么,为什么非独立事件也能预测,附代码实例
统计
回归均值——跌到谷底之后,数学保证你会回升跌到谷底后数学保证你会回升:回归均值这个统计陷阱,为什么让干预效果和模型评估都失真
统计
自由度——统计学里你只剩这么点自由了自由度到底是什么?三个数平均数为10时第三个已经定死——为什么它决定了你能用多少统计检验
统计
指数增长的盲区——e不是什么神秘常数,是你的直觉上限指数增长的认知盲区:2的64次方有多大、e从哪里来,为什么人对翻倍没有直觉,附增长曲线测算
统计
数据不会骗人,但分组会——辛普森悖论数据不会骗人,但分组会:1973年伯克利录取数据引发的辛普森悖论,条件概率如何反转结论
统计
平均数的暴政——当你不再是一个个体,而是一个均值1851年一个德国医生算了数万人体温的平均值,这个数进教科书待了一百多年。平均数为什么掩盖个体
统计
做风控的人都在说长尾分布——但你知道你的数据到底是不是幂律吗?你的数据真是幂律吗?长尾被滥用了。Python拟合加KS检验加似然比,三步分清幂律、对数正态与指数
统计
R语言评分卡最优cutoff——约登指数、成本效益与KS最大点评分卡cutoff怎么定?约登指数、成本效益分析与损失函数三种口径,附R语言实现与对比
风控
QIAN数据:我在风控策略里用了3年SHAP,发现最重要的不是特征重要性SHAP不只是解释工具:三年风控实战看特征重要性漂移,Shapley值可加性怎么做模型监控
风控
风控规则引擎实战:从RETE到决策表规则引擎从RETE算法到决策表:产生式系统怎么评估覆盖率与命中率,规则链冲突如何消解
风控
世界上最简单的数学定理,却不只是鸽子和洞鸽巢原理:看起来幼稚,却能推出Ramsey定理、生日悖论和Dirichlet逼近,含组合数学的经典应用
统计
为什么你认识的人总能通过不超过6个人认识任何人六度分隔是真的吗?Watts-Strogatz小世界模型解释现实网络为何既短又聚,附反欺诈网络应用
统计
一个期望值∞的游戏,为什么没人愿意出超过20块期望无限大却没人愿意玩:圣彼得堡悖论引出预期效用与风险厌恶,前景理论怎么解释真实决策
统计
正负开方术 vs Newton-Raphson:两种求解风控参数的数学哲学秦九韶的正负开方术比Newton-Raphson早了五百年:逐位试商的数值求解原理与逻辑回归求根
风控

2026年6月11 篇

三角函数在风控中的应用——循环特征编码与三角回归周期性变量怎么做特征:sin与cos循环编码加三角回归,用LendingClub月度违约率验证效果
风控
3个递推公式,100万次迭代,都收敛到同一个数——压缩映射的秘密压缩映射为什么能让迭代收敛:三个递推公式、一百万次迭代都到同一个数,含不动点存在性证明
统计
大模型当风控分析师:读报表、找问题、出策略大模型当风控分析师:读报表、找问题、出策略,函数调用架构加策略仪表盘异常检测的三层能力
LLM
6σ事件每几年发生一次?金融风险的厚尾真相厚尾分布揭示金融极端风险:沪深300峰度4.82,正态假设让VaR系统性低估,极值理论与巴塞尔ES转向
统计
每个被骗的人都说过一句话:我不会上当201份真实诈骗案件剖析:为什么越自信的人越容易被骗?信号检测理论和贝叶斯更新解释骗术本质
LLM
大模型在风控里到底能干什么?一个CART、LLM合并与评分卡的全面实测序贯覆盖、决策树与评分卡三套策略怎么比:用Lift、KS、AUC与策略曲线找到最优组合
LLM
因果推断实战——贷款金额×违约,一个反直觉的统计真相贷款金额对违约到底有多大影响?220万笔数据显示负向混杂让效应被低估2倍,DAG识别加逐步回归
统计
大模型在信贷风控中的实战:智能审单与欺诈文本识别大模型在信贷风控怎么用:智能审单与欺诈文本识别,零样本分类、混合模型与大模型边界的实测对比
LLM
欺诈团伙 vs 反欺诈系统:不是道高一尺魔高一丈,是数学的周期性战争反欺诈为什么总在反弹?用捕食者-猎物模型解释欺诈率周期性振荡,附微分方程与模拟代码
风控
切比雪夫不等式——任何分布都逃不出的概率边界切比雪夫不等式:不依赖任何分布假设的概率边界,从马尔可夫不等式完整推导到VaR与六西格玛实战
统计
模型说低风险你就放款了?——服从权威的数学致命曲线米尔格拉姆实验说65%的人会服从权威。当权威变成模型评分,风控决策会陷入同样的服从陷阱
职场

2026年5月4 篇

牛顿法 vs 梯度下降——二阶优化的力量牛顿法13步收敛、梯度下降要247步:二阶导数为什么更快,含Hessian推导与BFGS拟牛顿法对比
统计
大模型做信贷审批:闭卷考试不及格,开卷考试满分大模型做信贷审批合格吗?288条监管知识库加检索增强,闭卷与开卷的对比实测,附合规边界
LLM
你的公司自动分裂成两派,不是人心坏了,是数学派系是必然还是人心散了?结构平衡理论、谢林隔离模型、囚徒困境与沙普利值拆解组织政治
职场
风控决策引擎实战:从规则链到多源评分融合决策引擎不只是规则链:从贝叶斯决策风险最小化推出最优Cutoff,规则、评分卡与模型三层融合
风控

2026年3月1 篇

你的风控团队集体沉默了?不是人心散了,是信息级联的数学风控团队为什么集体沉默?信息级联模型表明,只要发言顺序不对,集体沉默就是数学必然
职场

关注公众号:QIAN数据