Navigate to WaytoAGI Wiki →

Home/Question List/Question Detail

视频语音翻译

Answer

以下是一些关于视频语音翻译的信息：

剪映的音视频翻译功能集合了语音识别、文本翻译、音色克隆、智能改口型等多个特色能力，效果好，音色还原度与翻译准确性较高，适用场景广泛。
VSP-LLM 可以将视频中的唇动转化为文本，实现视觉语音识别和翻译，基于 AV-HuBERT 模型，利用先进技术识别语音信息，智能去除不必要重复信息，提高处理效率。
MIRAGE 是一种提升医学问答性能的检索增强生成框架，使用最新可信文档辅助 LLMs，减少错误信息，提升回答准确性。
Genie 支持将合成图像、真实照片、手绘草图转化成可互动游戏场景，降低创造复杂虚拟环境门槛，加速内容创作和游戏开发。

Content generated by AI large model, please carefully verify (powered by aily)

References

【视频翻译】剪映全新AI功能介绍

多种先进性功能all in one。音视频翻译集合了语音识别、文本翻译、音色克隆、智能改口型等多个特色能力；效果好，音色还原度与翻译准确性较好。克隆本人音色非常真实生动，支持中英日三语自由切换翻译。适用场景广泛。该功能可以广泛应用在不同短视频场景，满足不同人群的需求。

XiaoHu.AI日报

?Xiaohu.AI日报「2月26日」 ✨✨✨✨✨✨✨✨1⃣️?VSP-LLM：理解和翻译视频中的唇语将视频中唇动转化为文本，实现视觉语音识别和翻译。基于AV-HuBERT模型，利用先进技术识别语音信息。智能去除不必要重复信息，提高处理效率。? https://github.com/facebookresearch/av_hubert? https://x.com/xiaohuggg/status/1762089975431237938?s=202⃣️?MIRAGE：提升医学问答性能的检索增强生成框架使用最新可信文档辅助LLMs，减少错误信息，提升回答准确性。MIRAGE应用MedRAG，某些模型性能提升至GPT-4水平。? https://teddy-xionggz.github.io/benchmark-medical-rag/? https://arxiv.org/abs/2402.13178? https://x.com/xiaohuggg/status/1762082522417262764?s=203⃣️?Genie：从单图生成无限可玩游戏场景支持合成图像、真实照片、手绘草图转化成可互动游戏场景。降低创造复杂虚拟环境门槛，加速内容创作和游戏开发。

XiaoHu.AI日报

?Xiaohu.AI日报「2月26日」 ✨✨✨✨✨✨✨✨1⃣️?VSP-LLM：理解和翻译视频中的唇语将视频中唇动转化为文本，实现视觉语音识别和翻译。基于AV-HuBERT模型，利用先进技术识别语音信息。智能去除不必要重复信息，提高处理效率。? https://github.com/facebookresearch/av_hubert? https://x.com/xiaohuggg/status/1762089975431237938?s=202⃣️?MIRAGE：提升医学问答性能的检索增强生成框架使用最新可信文档辅助LLMs，减少错误信息，提升回答准确性。MIRAGE应用MedRAG，某些模型性能提升至GPT-4水平。? https://teddy-xionggz.github.io/benchmark-medical-rag/? https://arxiv.org/abs/2402.13178? https://x.com/xiaohuggg/status/1762082522417262764?s=203⃣️?Genie：从单图生成无限可玩游戏场景支持合成图像、真实照片、手绘草图转化成可互动游戏场景。降低创造复杂虚拟环境门槛，加速内容创作和游戏开发。

Others are asking

coze 语音克隆

以下是关于语音克隆的相关信息：有一款适合小白用户的开源数字人工具，具有以下特点和功能：特点：一键安装包，无需配置环境，简单易用。功能：生成数字人视频，支持语音合成和声音克隆，操作界面中英文可选。系统兼容：支持 Windows、Linux、macOS。模型支持：MuseTalk（文本到语音）、CosyVoice（语音克隆）。使用步骤：下载 8G + 3G 语音模型包，启动模型即可。 GitHub 链接：官网链接：另外，CosyVoice 声音克隆仅需几秒音频样本，无需额外训练数据，可控制情绪情感、语速、音高。详细内容：https://xiaohu.ai/p/10954 项目地址：https://funaudiollm.github.io 在线演示：https://modelscope.cn/studios/iic/CosyVoice300M

GPTSoVITS 是一个用于声音克隆和文本到语音转换的开源 Python RAG 框架，具有以下特点和使用步骤：特点： 1. 零样本 TTS：输入 5 秒的声音样本即可体验即时的文本到语音转换。 2. 少量样本训练：只需 1 分钟的训练数据即可微调模型，提高声音相似度和真实感，模仿出来的声音更接近原声且自然。 3. 跨语言支持：支持与训练数据集不同语言的推理，目前支持英语、日语和中文。 4. 易于使用的界面：集成了声音伴奏分离、自动训练集分割、中文语音识别和文本标签等工具，帮助初学者更容易地创建训练数据集和 GPT/SoVITS 模型。 5. 适用于不同操作系统：项目可以在不同的操作系统上安装和运行，包括 Windows。 6. 提供预训练模型：项目提供了一些已经训练好的模型，可直接下载使用。使用步骤： 1. 前置数据获取处理：选择音频，开启切割。有噪音时，进行降噪处理。降噪处理完成，开启离线 ASR。 2. GPTSowitsTTS：训练集格式化：开启一键三连，耐心等待。微调训练：开启 SoVITS 训练和 GPT 训练。推理：开始推理刷新模型选择微调后的模型 yoyo。 3. 声音复刻：开启声音复刻之旅，可实现跨多语种语言的声音。相关资源： GitHub：https://github.com/RVCBoss/GPTSoVITS 视频教程：https://bilibili.com/video/BV12g4y1m7Uw/ 注册 colab 并启动准备：点击进入按照步骤注册即可 https://colab.research.google.com/scrollTo=Wf5KrEb6vrkR&uniqifier=2 ，新建笔记本，运行脚本启动 GPTSo VITS，整个过程比较漫长，需要耐心等待，可以整个脚本一起运行，也可以一段一段运行；运行过程包括克隆项目代码库、进入项目目录、安装 Python 依赖包、安装系统依赖、下载 NLTK 资源、启动 Web UI，运行成功后出现 public URL。实践样本： AIyoyo 普通话满江红 AIyoyo 粤语版满江红

文字转语音

以下是关于文字转语音的相关内容： DubbingX2.0.3：界面与国内版相同，使用了沉浸式翻译功能，可能看起来较乱。第一个选项是文字转语音，与国内版相同，不做重复演示。重点介绍第二项“创建您的语音克隆”：上传语音（想克隆的声音原始文件）。给声音命名，方便以后配音选择。选择语言。勾选相关选项，点击转变即可生成。注意：原音频若有背景音乐，最好在剪影中去除，以使生成的音色模型效果更好、更纯净。 Hedra：可以直接文字转语音，目前有 6 个语音。也可以直接上传音频。

语音转文字

以下是关于语音转文字的相关信息：推荐使用 OpenAI 的 wishper 进行语音转文字，相关链接：https://huggingface.co/openai/whisperlargev2 。一分钟搞定 23 分钟的音频，相关链接：https://huggingface.co/spaces/sanchitgandhi/whisperjax 。此项目在 JAX 上运行，后端支持 TPU v48，与 A100 GPU 上的 PyTorch 相比，快 70 多倍，是目前最快的 Whisper API 。语音转文本（Speech to text）：介绍：语音转文本 API 提供转录和翻译两个端点，基于开源大型v2 Whisper 模型。可用于将音频转录为任何语言，将音频翻译并转录成英语。目前文件上传限制为 25MB，支持 mp3、mp4、mpeg、mpga、m4a、wav 和 webm 等输入文件类型。快速入门：转录：转录 API 的输入是要转录的音频文件及所需输出格式的音频文字稿，默认响应类型为包含原始文本的 JSON，可添加更多带有相关选项的form 行设置其他参数。翻译：翻译 API 输入任何支持语言的音频文件，必要时转录成英语，目前仅支持英语翻译。更长输入：默认 Whisper API 仅支持小于 25MB 的文件，若音频文件更长，需分成小于 25MB 的块或使用压缩后格式，可使用 PyDub 开源 Python 软件包拆分声频文件，但 OpenAI 对其可用性或安全性不作保证。提示：可使用提示提高 Whisper API 生成的转录质量，如改善特定单词或缩略语的识别、保留分段文件的上下文、避免标点符号的省略、保留填充词汇、处理不同书写风格等。

实时翻译视频语音

以下是为您整理的相关信息：实时翻译视频语音的工具： StreamSpeech：这是一个实时语言翻译模型，能够实现流媒体语音输入的实时翻译，输出目标语音和文本，具有同步翻译、低延迟的特点，还能展示实时语音识别结果。给视频配音效的 AI 工具：支持 50 多种语言的配音，音质自然流畅，提供实时配音功能，适用于直播和演讲，能将语音转录为文本，方便后期字幕制作和编辑。 Vidnoz AI：支持 23 多种语言的配音，音质高保真，支持文本转语音和语音克隆功能，提供语音参数自定义和背景音乐添加工具，提供面向个人和企业的经济实惠的定价方案。在选择视频配音工具时，请考虑支持的语言数量、语音质量、自定义选项和价格等因素。

文本转语音

以下是关于文本转语音的相关信息：在线 TTS 工具推荐： Eleven Labs：https://elevenlabs.io/ ，是一款功能强大且多功能的 AI 语音软件，能高保真地呈现人类语调和语调变化，并能根据上下文调整表达方式。 Speechify：https://speechify.com/ ，是一款人工智能驱动的文本转语音工具，可作为多种平台的应用使用，用于收听网页、文档、PDF 和有声读物。 Azure AI Speech Studio：https://speech.microsoft.com/portal ，提供了支持 100 多种语言和方言的语音转文本和文本转语音功能，还提供了自定义的语音模型。 Voicemaker：https://voicemaker.in/ ，可将文本转换为各种区域语言的语音，并允许创建自定义语音模型，易于使用，适合为视频制作画外音或帮助视障人士。语音合成技术原理：传统的语音合成技术一般会经过以下三个步骤： 1. 文本与韵律分析：先将文本分词，标明每个字的发音以及重音、停顿等韵律信息，然后提取文本的特征，生成特征向量。 2. 声学处理：通过声学模型将文本特征向量映射到声学特征向量。 3. 声音合成：使用声码器将声学特征向量通过反变换生成声音波形，然后一次拼接得到整个文本的合成语音。在反变换过程中，可以调整参数，从而改变合成语音的音色、语调、语速等。 OpenAI 新一代音频模型： OpenAI 于 2025 年 3 月 20 日推出了全新的音频模型，包括改进的语音转文本和文本转语音功能。语音转文本模型在单词错误率和语言识别准确性方面相较于原有的 Whisper 模型有显著提升，能更好地捕捉语音细节，减少误识别，在多语言评估基准上表现优异。文本转语音模型具备更高的可定制性，支持个性化语音风格，目前支持人工预设的语音样式，并通过监控确保语音与合成预设一致。测试地址：https://www.openai.fm/ 直播回放：https://www.youtube.com/watch?v=lXb0L16ISAc 说明文档：https://openai.com/index/introducingournextgenerationaudiomodels/ 内容由 AI 大模型生成，请仔细甄别。

以下是关于文字生成视频（文生视频）的相关信息：一些提供文生视频功能的产品： Pika：擅长动画制作，支持视频编辑。 SVD：Stable Diffusion 的插件，可在图片基础上生成视频。 Runway：老牌工具，提供实时涂抹修改视频功能，但收费。 Kaiber：视频转视频 AI，能将原视频转换成各种风格。 Sora：由 OpenAI 开发，可生成长达 1 分钟以上的视频。更多相关网站可查看：https://www.waytoagi.com/category/38 。制作 5 秒单镜头文生视频的实操步骤（以梦 AI 为例）：进入平台：打开梦 AI 网站并登录，新用户有积分可免费体验。输入提示词：涵盖景别、主体、环境、光线、动作、运镜等描述。选择参数并点击生成：确认提示词无误后，选择模型、画面比例，点击「生成」按钮。预览与下载：生成完毕后预览视频，满意则下载保存，不理想可调整提示词再试。视频模型 Sora：OpenAI 发布的首款文生视频模型，能根据文字指令创造逼真且充满想象力的场景，可生成长达 1 分钟的一镜到底超长视频，视频中的人物和镜头具有惊人的一致性和稳定性。

以下是 4 月 11 日、4 月 9 日和 4 月 14 日的 AI 视频相关资讯汇总： 4 月 11 日： Pika 上线 Pika Twists 能力，可控制修改原视频中的任何角色或物体。 Higgsfield Mix 在图生视频中，结合多种镜头运动预设与视觉特效生成视频。 FantasyTalking 是阿里技术，可制作角色口型同步视频并具有逼真的面部和全身动作。 LAM 开源技术，实现从单张图片快速生成超逼真的 3D 头像，在任何设备上快速渲染实现实时互动聊天。 Krea 演示新工具 Krea Stage，通过图片生成可自由拼装 3D 场景，再实现风格化渲染。 Veo 2 现已通过 Gemini API 向开发者开放。 Freepik 发布视频编辑器。 Pusa 视频生成模型，无缝支持各种视频生成任务（文本/图像/视频到视频）。 4 月 9 日： ACTalker 是多模态驱动的人物说话视频生成。 Viggle 升级 Mic 2.0 能力。 TestTime Training在英伟达协助研究下，可生成完整的 1 分钟视频。 4 月 14 日：字节发布一款经济高效的视频生成基础模型 Seaweed7B。可灵的 AI 视频模型可灵 2.0 大师版及 AI 绘图模型可图 2.0 即将上线。

以下是为您提供的 AI 视频教学相关内容： 1. 第一节回放 AI 编程从入门到精通：课程安排：19、20、22 和 28 号四天进行 AI 编程教学，周五晚上穿插 AI 视频教学。视频预告：周五晚上邀请小龙问露露拆解爆火的 AI 视频制作，视频在视频号上有大量转发和播放。编程工具 tree：整合多种模型，可免费无限量试用，下载需科学上网，Mac 可拖到文件夹安装，推荐注册 GitHub 账号用于代码存储和发布，主界面分为工具区、AI 干活区、右侧功能区等。网络不稳定处理：网络不稳定时尝试更换节点。项目克隆与文件夹：每个项目通过在本地新建文件夹来区分，项目运行一轮一轮进行，可新建会话，终端可重开。 GitHub 仓库创建：仓库相当于本地项目，可新建，新建后有地址，可通过多种方式上传。 Python 环境安装：为方便安装提供了安装包，安装时要选特定选项，安装后通过命令确认。代码生成与修改：在 tree 中输入需求生成代码，可对生成的代码提出修改要求，如添加滑动条、雪花形状、颜色等，修改后审查并接受。 2. AI 视频提示词库：神秘风 Arcane：Prompt：a robot is walking through a destroyed city,,League of Legends style,game modelling 乐高 Lego：Prompt：a robot is walking through a destroyed city,,lego movie style,bright colours,block building style 模糊背景 Blur Background：Prompt：a robot is walking through a destroyed city,,emphasis on foreground elements,sharp focus,soft background 宫崎骏 Ghibli：Prompt：a robot is walking through a destroyed city,,Spirited Away,Howl's Moving Castle,dreamy colour palette 蒸汽朋克 Steampunk：Prompt：a robot is walking through a destroyed city,,fantasy,gear decoration,brass metal robotics,3d game 印象派 Impressionism：Prompt：a robot is walking through a destroyed city,,big movements

目前全世界最厉害的对视频视觉理解能力大模型是哪个

目前在视频视觉理解能力方面表现出色的大模型有： 1. 昆仑万维的 SkyReelsV1：它不仅支持文生视频、图生视频，还是开源视频生成模型中参数最大的支持图生视频的模型。在同等分辨率下各项指标实现开源 SOTA。其具有影视化表情识别体系、人物空间位置感知、行为意图理解、表演场景理解等优势。 2. 通义千问的 Qwen2.5VL：在 13 项权威评测中夺得视觉理解冠军，全面超越 GPT4o 与 Claude3.5。支持超 1 小时的视频理解，无需微调即可变身为 AI 视觉智能体，实现多步骤复杂操作。擅长万物识别，能分析图像中的文本、图表、图标、图形和布局等。

目前全世界最厉害的视频视觉理解大模型是哪个

目前全世界较为厉害的视频视觉理解大模型有以下几个： 1. 昆仑万维的 SkyReelsV1：不仅支持文生视频、图生视频，是开源视频生成模型中参数最大且支持图生视频的模型。在同等分辨率下各项指标实现开源 SOTA。其优势包括影视化表情识别体系、人物空间位置感知、行为意图理解、表演场景理解等。 2. 腾讯的混元：语义理解能力出色，能精准还原复杂的场景和动作，如特定品种的猫在复杂场景中的运动轨迹、从奔跑到跳跃的动作转换、琴音化作七彩音符等。 3. Pixverse V3.5：全球最快的 AI 视频生成模型，Turbo 模式下可在 10 秒内生成视频，最快仅需 5 6 秒。支持运动控制更加稳定、细节表现力强、首尾帧生成功能，具备顶尖动漫生成能力。

需要做一个自动化出视频的工作流

以下是一个关于自动化出视频工作流的详细介绍：优势：全自动化处理，解放双手。 40 秒快速出片，效率提升。成本低廉，每条仅需 0.0x 元。输出质量稳定专业。 DeepseekR1 保证文案质量。还能改进，例如可以加入配套 BGM，让视频更有感染力；增加更丰富的画面内容和转场效果；使用免费节点替代付费插件，进一步降低成本；优化模板样式，支持更多展示形式；增加自动化程度，支持批量处理。工作流程： 1. 可以在扣子商店体验，建议自己搭建。 2. 工作流调试完成后，加入到智能体中，可以选择工作流绑定卡片数据，智能体则通过卡片回复。 3. 选择发布渠道，重点如飞书多维表格，填写上架信息（为了快速审核，选择仅自己可用），确认发布等待审核，审核通过后即可在多维表格中使用。 4. 创建飞书多维表格，添加相关字段，配置选择“自动更新”，输入相关字段后，“文案视频自动化”字段捷径会自动调用工作流，生成视频。 5. 表单分享，实现“填写表单，自动创建文案短视频”的效果。 6. 全自动视频合成使用多视频融合插件，一键导出成品。但需注意节点产生的视频是异步生成，可能无法马上展现，需耐心等待几秒。如果您还有其他疑问或需要进一步的帮助，请随时联系。

图像翻译具有以下特点和功能：多语言支持：涵盖 18 种语言，包括中文、英文、法语、日语、韩语和西班牙语。保护图像主体：可选择不翻译品牌名称或重要信息，避免影响关键内容。高分辨率处理：支持高达 4000×4000 像素的图像，确保翻译后画质清晰。原始排版恢复：保留原字体、大小及对齐方式，确保设计一致性。多行文本合并：将多行文本合并为段落翻译，避免逐行翻译造成误解。清除文本痕迹：翻译后干净移除原文本，并恢复图像空白区域。

自动翻译英文文档

以下是关于您提出的“自动翻译英文文档”的相关内容：一个基于 Python 的网页截图工具具有自动翻译英文内容为中文的功能。在 Cursor 编辑器中，可直接在 Cursor Chat 里提出将中文版博客翻译成英文的要求，它会给出英文版本的文章，还能自动对比中英文文档并高亮差别，方便对英文进行直观修改，最终完成翻译。

找一下翻译插件

以下为您介绍一些翻译插件和方法： 1. 提示词翻译副本 Alekpet：插件地址：安装后重启 ComfyUI 即可。将 CLIP 文本编码器转换为输入，连接翻译文本节点即可使用。链接：https://github.com/kingzcheung/ComfyUI_kkTranslator_nodes 2. 提示词翻译副本 Prompt_Translate_to_English：用的百度翻译 API 方法如下：下载节点压缩包，并将它放在 custom_nodes 文件夹。去百度翻译 Api 和登记册开发人员的帐户中得到您的 appid 和 secretKey。百度翻译平台地址：https://fanyiapi.baidu.com/manage/developer 。打开文件 config.py 在记事本/其他编辑，填您的 secretKey 在引号的 secretKey =""，保存文件重启 Comfy 即可。 3. 翻译一份英文 PDF 完整地翻译成中文的方法： DeepL（网站）：点击页面「翻译文件」按钮，上传 PDF、Word 或 PowerPoint 文件即可。沉浸式翻译（浏览器插件）：安装插件后，点击插件底部「更多」按钮，选择「制作双语 BPUB 电子书」、「翻译本地 PDF 文件」、「翻译 THML/TXT 文件」、「翻译本地字幕文件」。 calibre（电子书管理应用）：下载并安装 calibre，并安装翻译插件「Ebook Translator」。谷歌翻译（网页）：使用工具把 PDF 转成 Word，再点击谷歌翻译「Document」按钮，上传 Word 文档。百度翻译（网页）：点击导航栏「文件翻译」，上传 PDF、Word、Excel、PPT、TXT 等格式的文件，支持选择领域和导出格式（不过进阶功能基本都需要付费了）。彩云小译（App）：下载后点击「文档翻译」，可以直接导入 PDF、PDF、Word、Excel、PPT、TXT、epub、srt 等格式的文档并开始翻译（不过有免费次数限制且进阶功能需要付费）。微信读书（App）：下载 App 后将 PDF 文档添加到书架，打开并点击页面上方「切换成电子书」，轻触屏幕唤出翻译按钮。浏览器自带的翻译功能：如果一些 PDF 太大，翻译工具不支持，除了将 PDF 压缩或者切分外，还可以转成 HTML 格式，然后使用浏览器自带的网页翻译功能。

以下是一些将英文 PDF 完整翻译成中文的方法和相关的 AI 产品： 1. DeepL（网站）：点击页面「翻译文件」按钮，上传 PDF、Word 或 PowerPoint 文件即可。 2. 沉浸式翻译（浏览器插件）：安装插件后，点击插件底部「更多」按钮，选择「制作双语 BPUB 电子书」、「翻译本地 PDF 文件」、「翻译 THML/TXT 文件」、「翻译本地字幕文件」。 3. Calibre（电子书管理应用）：下载并安装 Calibre，并安装翻译插件「Ebook Translator」。 4. 谷歌翻译（网页）：使用工具把 PDF 转成 Word，再点击谷歌翻译「Document」按钮，上传 Word 文档。 5. 百度翻译（网页）：点击导航栏「文件翻译」，上传 PDF、Word、Excel、PPT、TXT 等格式的文件，支持选择领域和导出格式（不过进阶功能基本都需要付费了）。 6. 彩云小译（App）：下载后点击「文档翻译」，可以直接导入 PDF、DOC、DOCX、PPT、PPTX、TXT、epub、srt 等格式的文档并开始翻译（不过有免费次数限制且进阶功能需要付费）。 7. 微信读书（App）：下载 App 后将 PDF 文档添加到书架，打开并点击页面上方「切换成电子书」，轻触屏幕唤出翻译按钮。 8. 浏览器自带的翻译功能：如果一些 PDF 太大，翻译工具不支持，除了将 PDF 压缩或者切分外，还可以转成 HTML 格式，然后使用浏览器自带的网页翻译功能。此外，在文档翻译工程侧还有以下方案架构和效果提升小技巧：方案架构：文件解析：从用户上传的 PDF 等格式的文档中解析出文字，智谱开放平台提供了限时免费的文件解析服务 API。预处理：提取出的文本可能会包含一些不必要的空格、特殊字符或者格式信息，需要对这些文本进行预处理，清除格式，标准化空格，以便于进行翻译。片段切分：当页面内容较长时，可以通过切分片段，并通过高并发请求大模型来减少整体耗时。模型调用：将预处理后的文本拼到 Prompt 模板中请求智谱模型 API。结果整合：翻译完成后，将翻译后的译文按照期望的样式展示在用户交互界面中。效果提升小技巧：自定义专业术语：同一词语在不同行业、场景的含义不同，推荐以 KV 对的形式进行专有名词的翻译。未来，随着大模型的不断迭代，GLM 等大语言模型将成为多语言翻译的主流核心底层技术，为全球用户带来更加精准、流畅的翻译体验。

ten可以安装在电脑里，然后电脑上可以看视频进行实时翻译吗？这个功能可以怎么去实现？

目前 Ten 不太明确是指何种具体的软件或工具。一般来说，如果您想在电脑上实现观看视频实时翻译的功能，可以考虑使用以下几种常见的方法： 1. 利用浏览器插件：例如谷歌浏览器的某些翻译插件，能够在您观看在线视频时提供翻译服务。 2. 专业的翻译软件：部分专业的翻译软件具备屏幕取词和实时翻译视频的功能。 3. 操作系统自带的功能：某些操作系统可能提供了相关的辅助功能来实现类似的效果。但需要注意的是，不同的方法可能在翻译的准确性、支持的语言种类以及适用的视频平台等方面存在差异。