今天给大家演示一个《假如书籍会说话》Coze 工作流。这个工作流通过大模型生成书籍拟人化对话文案,并结合语音合成、画板背景与代码逻辑,将书籍转化为可交互的“会说话的视频书籍”。最终效果是观众可以直观感受到主持人与书籍的跨时空对话,让阅读体验升级为沉浸式视听内容。
文章目录
- 工作流介绍
- 核心模型
- Node节点
- 工作流程
- 大模型应用
- 生成对话文案
- 使用方法
- 应用场景
- 开发与应用
工作流介绍
该工作流主要围绕“书籍内容对话化、语音化与视频化”展开。其核心是利用大模型解析书籍并生成拟人化的主持人与书籍对话,再通过语音合成节点将文本转为声音,结合画板背景与代码逻辑整合音频、字幕和图像,最终产出可直接应用的视频作品。整个流程形成了从输入书籍信息 → 大模型生成对话 → 语音合成 → 背景与字幕排版 → 视频合成的闭环。
核心模型
工作流使用了豆包·1.5·Pro·深度思考·128K作为主力大模型。该模型负责根据书籍名称与作者信息,生成长篇对话文案,涵盖角色设定、提问逻辑和字幕格式,保证生成内容既有深度又能直接转化为口播文案。它在流程中扮演“知识内容生成核心”,决定了整个视频的质量与专业性。
| 模型名称 | 说明 |
|---|---|
| 豆包·1.5·Pro·深度思考·128K | 负责根据书籍信息生成主持人与书籍的拟人化对话文案,输出符合字幕和口播要求的内容 |
Node节点
整个工作流的节点设计涵盖了从生成文案、合成语音、背景画板到代码逻辑整合的全链路。大模型节点生