重写问题
“低风险与高风险工单的总处理时长是否改善,且事实错误不升?”首次回复只是流程中的一个阶段。
《用图表说话》提醒我们:图形不是数据的容器,而是沟通选择。本页把它接入当代技术工作——先写决策问题,再选比较任务与视觉编码,同时公开口径、不确定性和下一动作。
你要向负责人说明 AI 助手试点效果。表格有 18 个指标,仪表盘提供 12 种图。若从“做一张漂亮图”开始,你很容易把能找到的数据都放进去。先写一句判断问题:“试点是否在不增加事实错误和人工返工的前提下,缩短了不同工单类型的总处理时间?”
这句话确定了四件事:比较对象是试点前后及工单类型;主要结果是总处理时间;护栏是事实错误和人工返工;动作是决定是否扩大。接着才选择图形。趋势看随时间变化,条形看类别高低,分布看差异和长尾,散点看关系,流程图看阶段损耗。
探索阶段可以画很多图发现模式;对外决策图只保留一项主要判断。不能删掉会推翻结论的反例,但可以把次要诊断放到附页,并在主图明确链接。
人更容易准确比较共同基线上的位置和长度,因此类别比较通常优先排序条形而非饼图;时间趋势通常用连续位置的折线。面积、角度和颜色深浅适合展示大致模式,不适合要求读者精确区分 17% 与 19%。三维透视会进一步扭曲大小。
颜色最好表达有限的语义:蓝色是主序列,橙色是风险或偏离,灰色是背景。不要让七种颜色只代表七个类别后再要求读者来回查图例。重要变化应同时用文字、形状或标注表达,避免只靠色觉。
坐标轴要与任务匹配。条形图用长度比较,截断零点会夸大差异;折线关注变化,某些情况下可以截取合理范围,但必须显著标出,并提供基线背景。排序应帮助判断:按值、时间或业务阶段,而非默认字母顺序。
| 层 | 检查问题 | 合格证据 |
|---|---|---|
| 问题 | 读者看完要完成哪项比较或决定? | 一句可回答标题,不是“月度数据概览” |
| 数据 | 分母、时间窗、样本、缺失与口径是否可复建? | 图注写来源与定义,口径断点显式标记 |
| 编码 | 视觉通道是否适合精度,是否制造夸大? | 共同基线、单位、可辨识颜色、无装饰 3D |
| 叙事 | 标题是否诚实,反例和边界是否同屏? | 结论—证据—边界—动作四句齐全 |
原稿。负责人用两根从 95 到 100 开始的柱子展示首次回复从 10 分钟降到 7 分钟,标题写“效率提升 30%,验证成功”。图中没有总处理时长、样本、工单类型和错误率。读者自然得出“应该全量”。
“低风险与高风险工单的总处理时长是否改善,且事实错误不升?”首次回复只是流程中的一个阶段。
按工单类型分层;总时长包含首次回复、追问、转人工和返工;同时展示样本 n 与中位数/P90,避免平均数遮住长尾。
主图用分组点图比较各类工单前后总时长;旁边小表列严重错误与转人工。颜色只强调达到预设阈值的类别。
“低风险工单总时长下降 14%,退款争议无改善且严重错误 2 条;建议仅扩大低风险影子试点。”
新图没有否定 30% 这个计算,而是说明它只描述一个局部指标。可视化的工作不是让数字更有冲击力,而是让读者完成正确比较。若数据本身不足,图表应明确“尚不能判断”,而不是用更鲜艳的颜色补信心。
美化不能修复错误分母和虚假基线。先删图,写判断问题与口径,再重新选择编码。
读者不知道看哪里。保留一个主要判断;其他结论拆成小倍图或附页,标题各自明确。
延迟、工单和成本常有偏态。增加中位数、P90/P95 或分布,解释异常值处理。
散点的上升趋势不证明因果。标题用“相关”,并列出混杂与下一验证。
两个刻度可随意调整,看似高度相关。优先标准化、小倍图或直接计算关系并公开方法。
至少写系统/表、查询或版本、时间窗、过滤、样本、缺失和口径断点,确保他人可复建。
第三人 30 秒后能准确复述主要比较、数据范围、一个关键边界和建议动作;图表没有依赖截轴、面积或装饰制造夸大。完成后回到第 06 章数据表达,把图接入真实决策文档。