← 返回 · 行动与价值 已发布
互联网公益项目逻辑自洽性百项快检观察
基于 insigoo SIA v1.2 逻辑自洽层,对腾讯公益平台 100 个项目做的大规模扫描——这是 SIA 标准下第一份正式对外应用产出。
里程碑:这是 insigoo SIA 社会影响力评估框架下的第一份正式对外产出。我们用它把”项目到底讲不讲得通”从主观判断变成了可批量、可复核的结构化观察。
我们做了什么
从腾讯公益乐捐平台抽取 100 个筹款项目(教育助学、医疗救助、乡村振兴、自然保护、关怀倡导五大类目各 20 个,目的性抽样),运用 SIA v1.2 逻辑自洽层(L1) 的 10 项指标做快速检查(快检):
- 四个维度:逻辑链完整性、假设风险、目标-方法-行动一致性、受益方视角
- 10 项指标:从”受益群体是否具体”到”是否识别潜在负面影响”
- 统一加权计分:✅=1 / ⚠️=0.5 / ❌=0,满分 10 分
- 人机协同 + 全量公开:AI 初评 → 人工复核 → Python 脚本逐维校验,100 个项目的逐维评分、统计脚本、绘图脚本随报告一并开源,全部数字可一键复算
核心发现
1. 整体水位:平均 4.97 / 10,中位数 5.0
| 分档 | 标准 | 数量 | 占比 |
|---|---|---|---|
| 🟢 优先推进 | ≥6 分 | 21 | 21% |
| 🟡 补充复评 | 3–5.5 分 | 76 | 76% |
| 🔴 暂不推荐 | <3 分 | 3 | 3% |
79% 的项目未达到”优先推进线”——但其中绝大多数并非”差项目”,而是”说不清楚自己好在哪”的中间地带项目。
2. 类目差异:医疗稳居第一,教育不是垫底而是分化最剧烈
- 医疗救助 5.50 分(20 个项目全部 ≥4 分,唯一无低分的类目);
- 教育助学 4.70 与乡村振兴 4.62 并列榜尾,但教育内部差异全场最大(标准差 1.45)——全场第二高分(7.5)与最低分项目都出自教育类;
- 项目类型比项目类别更能预测快检质量:有物资产出或第三方独立评估的项目明显更高。
3. 三个行业结构性盲区(完全通过率近 0)
- 核心假设明确写出:11%
- 反事实思考(“没有这个项目会怎样”):7%
- 负面影响识别:3%
而”受益群体明确""目标方法行动一致”等基础项已近乎全员通过——行业完成了”披露了没有”,但远未做到”讲不讲得通”。
4. 两个反直觉结论
- 预算规模与快检得分无可检测的相关性(Spearman ρ = −0.16,n=85,p≈0.14):县级机构以”单一病种 + 分档救助 + 公示”达 6.0 分,亿元级综合大盘反而因成果无法归因集中在 4.0–4.5 分。
- 受益方治理结构是最锋利的一刀:本样本中患者/家长自组织项目全部进入”优先推进”档。
为什么重要
既有透明度评估(如 FTI)回答的是”机构是否披露了规定信息”(合规层面),而本研究用 SIA 框架回答一个不同的问题:项目披露出来的内容,在逻辑上讲不讲得通。两者互补——一个项目可以完全合规地披露了一套讲不通的逻辑。
这正是 SIA 作为”公益行业基础设施·行动与价值”支柱的增量价值:把影响力评价从模糊叙事推向结构化、可复核的判断。
完整报告与数据
- 全文、逐项目评分明细、复算脚本与数据包已开源(CC BY-NC-SA 4.0):GitHub · ericyueric/sia-100-report
- 评估框架方法学见 👉 公益项目社会影响力评价 SIA