文本摘要
把长文压成更短、仍准确的版本
语言与知识入门 #04
输入文本文本
这项能力指什么
输入一篇长文,输出保留关键信息的短版本。可分为抽取式(挑出原文句子)与生成式(用自己的话重写)两类,现在主流是生成式。它与「文本生成」的区别是明确的压缩目标,与「问答」的区别是不针对某个具体问题,而要覆盖全文主线。
技术上如何做到
经典做法是基于注意力序列到序列模型做生成式摘要,指代词与长句的改写靠大规模预训练获得。长文档通常先用层次化或分段-汇总(map-reduce)的方式处理,再拼接成终稿。受控摘要会给定长度、角度或受众,通过提示或少量微调控制输出风格。
代表产品
8GPT-4o
2024OpenAI
原生多模态的通用模型,文本、图像与音频走同一个入口
模型 闭源
文本图像音频文本音频
Claude
2023Anthropic
以长上下文与安全对齐见长的通用对话模型
模型 闭源
文本图像文本
Gemini
2024Google DeepMind
把搜索、办公与多模态模型收进一个对话入口
应用 免费增值
文本图像音频文本图像音频
NotebookLM
2023Google DeepMind
只用你给它的资料作答,并逐条给出出处
应用 免费增值
文本表格音频文本音频
Kimi
2023Moonshot AI
以长上下文处理见长的中文对话助手
模型 闭源
文本文本
Apple Intelligence
2024Apple
端侧与私有云协同的系统级 AI 功能
应用 闭源
文本图像音频文本图像
Microsoft Copilot
2023Microsoft
把对话式 AI 嵌进操作系统与办公软件
应用 免费增值
文本图像音频文本图像
Perplexity
2022Perplexity AI
边检索边作答、每条答案都带出处
应用 免费增值
文本文本
相关机构
典型用途
- 新闻与报告的速读摘要
- 会议记录与通话纪要
- 文献综述与论文速览
- 工单与邮件的归并摘要
怎么评价它好不好
- ROUGE
- 摘要与参考摘要的 n-gram 重叠度
- BERTScore
- 用语义嵌入衡量相似度,比字面重叠更宽容
- 事实一致性
- 摘要中与原文冲突的陈述比例,如 FactCC 一类评测
边界与难点
- 长文档中段内容常被遗漏,模型更偏向开头与结尾
- 生成式摘要会把不同句子的事实拼接,产生原文没有的结论
- 对含糊或多方立场的文本,容易把少数意见写成多数意见