对话转录与锁定
提取原视频对白与时间码,逐句校对,保留关键数字、谐音、包袱、反击方式和收尾。
Agent不是只写一段脚本,而是把原片证据、对话、镜头、素材和发布文案连成一条可执行的生产链。
提取原视频对白与时间码,逐句校对,保留关键数字、谐音、包袱、反击方式和收尾。
识别人物、动作、景别、运镜、表情、环境、字幕和触发反转的非语言信息。
按故事功能、景别、运镜、动作、台词、节奏、情绪和音效,建立带时间码的拆解表。
在锁定对话的前提下,适度改编人物、场景、道具、动作、表情、构图和镜头节奏。
输出角色锚点、场景设定和逐镜头提示词,并标明素材状态、淘汰条件和人工审核点。
规划字幕、音效、转场、节奏和导出参数,并分别生成抖音、快手和视频号文案。
流程设置两个关键人工确认点:先锁定对话,再审核最终交付。未经确认,Agent不会修改关键对白或自动发布。
检查链接、MP4、主题、平台、画幅和权利状态。
转录对白、抽取关键帧、检测镜头并识别字幕。
逐句确认对话。视觉设定冲突时,调整视觉而不是改写对白。
完成八维拆解、人物场景、脚本、分镜和提示词。
确认时长、风险、素材状态、剪辑方案和平台文案。
输入越清楚,交付越稳定。对标链接负责提供背景和传播数据,MP4负责保证内容可解析。
页面只展示脱敏后的运行事实。聊天ID、用户ID、密钥、内部路径和完整日志不会公开。
测试主题为“职场沟通中的解气反转”,对标视频时长36.27秒。Agent完成了内容提取、关键帧分析、九段八维拆解、完整脚本、十四镜分镜、提示词、剪辑方案、平台文案及风险记录。
说明:该样例由旧版Profile生成,曾对原对话进行改写。当前Profile已经升级为“先锁定并复刻对话,再改编视觉”。
Codex负责配置与维护,Hermes负责运行和调度;视频处理、语音转录、OCR和视觉模型各自完成独立环节。
公开页面本身也是只读对象:不会连接你的Agent,不会接收文件,不会产生模型费用,更不会暴露内部权限。
公开访客只能查看说明。真正使用时,需要由管理员将使用者加入允许范围,再向视频策划Bot提交任务。