
你将学会
- 比较两类模型处理长文档时的上下文、检索精度与成本
- 设计可复现的长文档问答测试
- 按文档规模与预算选择合适模型
适合谁
- 需要处理报告、论文或合同的知识工作者
- 负责模型选型与评估的团队
课前准备
- 能访问 Claude 与 ChatGPT
- 准备一份可公开测试的长文档
课程目录
1 课时 · 11 分钟- 01Claude 3.5 与 GPT-4o 谁更适合长文档从上下文窗口、检索精度与成本三个维度,对比两大模型处理长文档的表现。图文11 分钟开始本课
课程说明
我们用同一批长文档分别喂给 Claude 3.5 Sonnet 与 GPT-4o,量化对比召回与成本。