微信扫码
添加专属顾问
我要投稿
最近学习AI的时候,经常要看一些视频资料。但有些视频内容比较长,完整看下来比较花时间。
所以,就想着用大模型对视频内容先做一次总结,然后再有选择性地去看。
一不小心,就开发了一个视频总结智能体。
下面就给朋友们分享一下核心科技,啊哈哈。
第一步,获取视频
这里用小破站上讲解 GPT 的视频为例
用扣子中的插件,输出视频url就可以下载视频
第二步,提取视频内容
这里只提取了视频字幕。分两小步,先分离视频中的音频,再调用ASR语音识别技术,将音频转成文本。
这两步虽然在扣子中都有对应的插件,但我试了下没成功。就自己动手开发了一个插件。
代码是用大模型生成的。将插件发布后,就可以在工作流中使用了
第三步,总结视频内容
这个视频有27分钟,并且是英文版,提取的字幕大小30kb。长文本内容总结,当然用 Kimi。
Kimi可以帮我们总结、提炼,生成中文版的核心要点。
纯文字版内容读起来还是差点意思,我们可以继续添加插件,将 Kimi 生成的内容做成思维导图。
这样,一个27分钟的视频,经过智能体总结,分分钟掌握其中的核心要点。学习效率嗖嗖的。
这个智能体我们只能提取了字幕进行总结,其实还可以提取视频关键帧,送入视觉大模型,进行内容生成或者问答。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-04-25
OpenAI 白送 200 美元的深度研究功能?实测后发现这个「阉割版」不如不用
2025-04-25
为什么一定要做Agent智能体?
2025-04-25
哇!首个MCPBench来了,MCP竟然不比Function Calls更有优势? | 最新
2025-04-25
医疗大模型案例分析(一):Google Med-PaLM
2025-04-25
vLLM+Qwen-32B+Open Web UI构建本地私有大模型
2025-04-25
AI产品经理思考MCP(3):MCP的未来可能
2025-04-25
AI产品经理思考MCP协议(2):标准化的必要性
2025-04-25
AI产品经理思考MCP协议(1):预见MCP——我的“万能库”与标准化之路
2024-08-13
2024-06-13
2024-08-21
2024-09-23
2024-07-31
2024-05-28
2024-08-04
2024-04-26
2024-07-09
2024-09-17