测试设置
用三场会议做样本:
- 两人一对一沟通(安静环境)
- 五人项目评审(有交叉发言)
- 远程会议(含网络回声与个别听不清的片段)
关注三点:转写准确率、发言人区分、待办事项抽取。
一、转写准确率
- 安静环境下准确率最高,口语中的语气词基本能自动清理
- 测试中出现较多的是同音词误判,尤其是产品名、人名、专有缩写
- 远程会议里听不清的片段,模型会尝试补全,这是最容易产生错误信息的地方
对策:会后把专有名词表(人名、产品名、缩写)提供给它做一次替换校正,能修掉大部分错误。
二、发言人区分
- 发言人数量少、轮换清晰时,区分较准确
- 出现插话、重叠发言时,归属容易出错
- 结论性发言被归给错误的人,是纪要里后果最严重的一类错误
对策:涉及责任分配的内容(谁负责、什么时候完成),必须人工确认后再发出。
三、待办事项抽取
这是最实用的一环:能从讨论中抽出待办,并整理成列表。
但要注意:
- 它分不清「讨论中的想法」和「已确认的行动项」
- 时间表述(下周、月底)有时会被转成不准确的日期
对策:让它明确标注「待确认」,并附上依据原话,便于快速核对。
使用前必须确认的两件事
- 录音与上传是否合规:会议录音涉及他人,需提前告知并取得同意
- 数据存储位置与保留期限:涉及内部信息时,确认是否会被用于训练、保留多久、能否删除
结论
AI 纪要能显著减少整理时间,适合做初稿。但凡涉及责任人、时间点、专有名词的部分,都要人工核对后再分发。隐私合规要在使用前确认,而不是事后补救。