Navigate to WaytoAGI Wiki →
Home/All Questions
什么是MOE?
MoE(Mixture of Experts)架构是一种深度学习模型结构,由多个专家网络组成,每个专家网络负责处理特定的任务或数据集。其核心思想是将一个大的、复杂的任务拆分成多个小的、简单的任务,并让不同的专家网络负责处理不同的任务。这样做的好处是可以提高模型的灵活性和可扩展性,同时减少模型的参数量和计算量,从而提高模型的效率和泛化能力。 MoE 架构的实现通常需要以下几个步骤: 1. 定义专家网络:首先需要定义多个专家网络,每个专家网络负责处理特定的任务或数据集。这些专家网络可以是不同的深度学习模型,如卷积神经网络(CNN)、循环神经网络(RNN)等。 2. 训练专家网络:使用有标签的训练数据对每个专家网络进行训练,以获得每个专家网络的权重和参数。 3. 分配数据:在训练过程中,需要将输入数据分配给不同的专家网络进行处理。分配数据的方法可以是随机分配、基于任务的分配、基于数据的分配等。 4. 汇总结果:将每个专家网络的输出结果进行加权求和,得到最终的输出结果。 5. 训练模型:使用有标签的训练数据对整个 MoE 架构进行训练,以获得最终的模型权重和参数。 MoE 架构在自然语言处理、计算机视觉、语音识别等领域都有广泛的应用。例如,苹果构建了参数最高可达 300 亿的多模态模型系列 MM1,它由密集模型和混合专家(MoE)变体组成,在预训练指标中实现 SOTA,在一系列已有多模态基准上监督微调后也能保持有竞争力的性能。阿里通义千问也有大型专家模型(MoE),如 Qwen2.5Max 基于 SFT 和 RLHF 策略训练,在多项基准上超越 DeepSeek V3,引发社区关注。
2025-03-21
COZE接入企业微信
要将 COZE 接入企业微信,可参考以下步骤: 1. 登录宝塔面板,在宝塔面板中可视化控制云服务器,部署 docker 容器,启动 COW 项目与微信取得关联。具体操作包括:点击“Docker”中的“项目模板”中的“添加”按钮,将编译好的内容复制进来,在容器中创建容器,选择容器编排,填入模板和名称,确定。运行成功后,点击容器,可看到运行的两个服务。然后点击“wcandyaibot”后面的日志按钮,在弹出层中用提前预备好的微信进行扫码。此界面不会实时更新显示,需手动刷新,若看到“WeChat login success”,则接入微信成功。 2. 在扣子官网左下角选择扣子 API,在 API 令牌中选择“添加新令牌”,为令牌命名,选择永久有效作为过期时间,选择指定团队空间,勾选所有权限。保存好令牌的 Token,切勿向他人泄露。 3. 获取机器人 ID:在个人空间中找到要接入微信的机器人,进入机器人编辑界面,浏览器地址栏“bot/”之后的数据即为该机器人的 Bot ID。 4. 进行 API 授权:点击右上角发布,勾选 Bot as API,确定应用已成功授权 Bot as API。 5. 配置微信客服: 访问微信客服 https://kf.weixin.qq.com/,点击开通,勾选同意,点击下一步,按步骤填写,注册企业微信。 点击配置>到微信客服的企业信息,复制企业 ID>到 coze 页面进行粘贴填写企业 ID,并点击下一步。 到微信客服的开发配置,找到回调配置,复制 Token、EncodingAESKey(若为空,点击“随机获取”),到 coze 页面进行粘贴,点击下一步。 到微信客服的开发配置,配置回调地址 URL、复制 Secret 到 coze 的页面粘贴。 到微信客服的客服账号,创建一个客服账号,复制客服账号名称,到 coze 的页面粘贴,点击保存。 注意:目前需要企业认证,才可以进行接入微信客服。如果企业没有进行认证,则会在配置回调 URL 时报错:回调域名校验失败。另外,之前未进行企业认证就发布过微信客服的不受影响。
2025-03-21
什么是AIGC
AIGC(人工智能生成内容)是一种利用人工智能技术生成各种类型内容的应用方式。 它能够通过机器学习和深度学习算法,根据输入的数据和指令生成符合特定要求的内容,在内容创作、广告、媒体等领域有着广泛的应用。 具体来说: 1. 文字生成:使用大型语言模型(如 GPT 系列模型)生成文章、故事、对话等内容。 2. 图像生成:使用 Stable Diffusion、DALLE 等模型生成艺术作品、照片等。 3. 视频生成:使用 Runway、KLING 等模型生成动画、短视频等。 AIGC 作为一种强大的技术,能赋能诸多领域,但也存在多重潜在的合规风险。目前,我国对 AIGC 的监管框架由《网络安全法》《数据安全法》及《个人信息保护法》构成,并与《互联网信息服务算法推荐管理规定》、《互联网信息服务深度合成管理规定》、《生成式人工智能服务管理暂行办法》、《科技伦理审查办法(试行)》等形成了共同监管的形势。 AIGC 主要分为语言文本生成、图像生成和音视频生成。语言文本生成利用马尔科夫链、RNN、LSTMs 和 Transformer 等模型生成文本,如 GPT4 和 Gemini Ultra。图像生成依赖于 GANs、VAEs 和 Stable Diffusion 等技术,应用于数据增强和艺术创作,代表项目有 Stable Diffusion 和 StyleGAN 2。音视频生成利用扩散模型、GANs 和 Video Diffusion 等,广泛应用于娱乐和语音生成,代表项目有 Sora 和 WaveNet。此外,AIGC 还可应用于音乐生成、游戏开发和医疗保健等领域,展现出广泛的应用前景。 AIGC 应用可能引发内生风险、数据隐私问题和知识产权风险。内生风险包括算法的不可解释性和不可问责性,以及代码开源可能带来的安全和伦理担忧。数据隐私方面,AIGC 工具可能导致数据泄露、匿名化不足、未经授权的数据共享等问题。应用风险涉及作品侵权、不当竞争等问题。相关法律和规定对 AIGC 的透明性、数据收集和处理、知识产权归属等提出了要求。然而,著作权归属、数据隐私等问题尚需更多法律明确规定。此外,AIGC 的滥用可能导致虚假信息传播、侵犯隐私等问题,因此需要进一步加强监管和伦理约束。 例如 AI 文本续写,文字转图像的 AI 图、AI 主持人等,都属于 AIGC 的应用。类似的名词缩写还有 UGC(普通用户生产),PGC(专业用户生产)等。能进行 AIGC 的产品项目也很多,能进行 AIGC 的媒介也很多包括且不限于: 1. 语言文字类:OpenAI 的 GPT,Google 的 Bard,百度的文心一言,还有一种国内大佬下场要做的的 LLM 都是语言类的。 2. 语音声音类:Google 的 WaveNet,微软的 Deep Nerual Network,百度的 DeepSpeech 等,还有合成 AI 孙燕姿大火的开源模型 Sovits。 3. 图片美术类:早期有 GEN 等图片识别/生成技术,去年大热的扩散模型又带火了我们比较熟悉的、生成质量无敌的 Midjourney,先驱者谷歌的 Disco Diffusion,一直在排队测试的 OpenAI 的 Dalle·2,以及 stability ai 和 runaway 共同推出的 Stable Diffusion。 其中,SD 是 Stable Diffusion 的简称。是它是由初创公司 StabilityAI、CompVis 与 Runway 合作开发,2022 年发布的深度学习文本到图像生成模型。它主要用于根据文本的描述产生详细图像。Stable Diffusion 是一种扩散模型(diffusion model)的变体,叫做“潜在扩散模型”(latent diffusion model;LDM)。SD 的代码模型权重已公开发布,可以在大多数配备有适度 GPU 的电脑硬件上运行。当前版本为 2.1 稳定版(2022.12.7)。源代码库:github.com/StabilityAI/stablediffusion 。我们可以通过一系列的工具搭建准备,使用 SD 进行想要的图片 aigc(心想事成的魔法施与)。
2025-03-21
写Prompt的技巧
以下是关于写 Prompt 的技巧: 1. 明确任务:清晰定义任务,如写故事时包含背景、角色和主要情节。 2. 提供上下文:若任务需特定背景知识,提供足够信息。 3. 使用清晰语言:尽量用简单、清晰的语言,避免模糊或歧义词汇。 4. 给出具体要求:如有特定格式或风格要求,在 Prompt 中明确指出。 5. 使用示例:如有特定期望结果,提供示例帮助 AI 模型理解需求。 6. 保持简洁:避免过多信息,防止 AI 模型困惑。 7. 使用关键词和标签:有助于模型理解任务主题和类型。 8. 测试和调整:生成文本后检查结果,根据需要调整 Prompt 。 此外,编写 Prompt 还可注意以下几点: 尽可能多挖掘需求信息。 把需求信息变成清晰合理的 Prompt 。 不断尝试迭代,直至 Prompt 能解决问题。 在写 Prompt 时,利用 Fewshots 技巧也很实用,通过提供 1 3 个输入 输出示例,让 GPT 学到样本共性,提升输出结果质量。可在“如何写好 Prompt:结构化”的基础上,增加“Examples:”结构块,举 1 3 个示例。
2025-03-21
什么是Prompt
Prompt 是指您给 AI 模型(如 Claude 等)的文本,用于引发相关输出。它通常以问题或指示的形式出现,例如“为什么天空是蓝色的?”。简单来说,它是一套您和大模型交互的语言模板,通过这个模板,您可以输出对于大模型响应的指令,明确模型应该做什么、完成什么任务、如何处理具体任务,并最终输出您期望的结果。 从更专业的角度来看,大模型的本质是一个基于语言的概率模型,Prompt 给了一个模板,包括对模型的要求、输入和输出的限制,大模型在这个限制下得到概率最大的答案。 此外,每个单独的提示词叫 tag(关键词),支持英语等语言(不用担心英语不好的问题,可点击相关链接获取提示词字典),emoji 也可以使用。在语法规则方面,用英文半角符号逗号来分隔 tag,逗号前后有空格或者换行不影响效果;可以改变 tag 权重,有不同的写法;还可以进行 tag 的步数控制。
2025-03-21
什么是deepseek
DeepSeek 是一家专注于人工智能基础技术研究的科技公司,成立于 2023 年 9 月,总部位于中国杭州,定位是聚焦大模型研发与应用,提供高效、安全、可控的 AI 技术解决方案。 DeepSeek 也是一个品牌名,旗下产品如 Deep Research 是基于 AI 模型的,需要搭配具体模型,如 DeepSeek V3(类 GPT4o)和 DeepSeek R1(类 OpenAI o1)。 此外,HiDeepSeek 是为解决使用 AI 工具时答案思考过程不透明的问题而设计的工具,它能让 AI 像人类交流时那样展示思考过程,通过特别的规则要求 AI 思考自然,在技术层面实现思维过程的透明化,帮助人们更好地理解和使用 AI 。
2025-03-21
即梦Ai生成的图片版权问题,可商用吗
AI 生成的图片版权问题较为复杂,目前尚无统一明确的定论。以下是一些相关要点: 在作品上署名,表明自己的作品身份(署名权);将作品公之于众,或以个人网络账号在任何公众平台上发布(发表权、信息网络传播权);将作品作为画册、影集等出售或在美术馆展览(复制权、发行权、展览权);以画作为基础进行二次改变,创作动画、电影等新作品(改编权);授权他人修改、二创开发(修改权)。为预防个人权利受到侵害,在创作完成时可采取相应措施,如附上能够表明个人身份信息的水印、标识;发表时明确注明授权的方式、内容,是否许可二改二传、是否禁止商用等;在对外授权时要细致处理授权内容,细分著作权,做到“权有所值”。 虽然创作完成就自动享有了著作权,但是仍然需要留存相关的证据来证明是自己构思完成的。例如保留图片生成过程的视频,当使用人工智能软件辅助创作时,创作者应当注意留存具体操作步骤的证据,例如视频操作录制,直播片段等等能够证明自己是如何生成最终作品的过程性文件、创作底稿等,并记录下生成作品的具体时间,这个时间即是著作权产生的时间。还可以进行版权登记,作者可到版权登记大厅或通过邮寄方式向中国版权保护中心著作权登记部提交登记申请材料办理,登记机构受理后会进行审查,通过后制作发放登记证书并在网站上进行公告。通过版权登记可以为作者和作品完成时间提供证明。在进行作品的价值开发时,也要注意保留相关材料,例如发表平台的账号、上传时间、商业合作合同等等。 AI 绘画的版权问题一直备受争议。特别是在 Midjourney 流行后,用户无需自己搭模型就可以轻松获取大量 AI 生成的图像,但其是否道德或合法,仍存在争议。对此,人们有两种看法:一方认为 AI 只是从现有的素材库中拼接和重塑内容,真正的创意都来自原始的艺术家;而另一方则认为 AI 绘画也需要创意,prompt 可以体现这一点。旧的法律法规未能覆盖 AI 相关的场景,包括国内著作权内容都未对 AI 相关的说明。在新的法律法规出台之前,使用 AI 制作的图版权都可能是公版,即不能保证著作权。因此,为了确保自己的版权,最好将机器生产的内容作为原始素材,在后期上多下点工夫突出“人类创作”的部分。 例如在某案例中,Stable Diffusion 模型根据文本指令生成图片,其生成的图片取决于使用者输入的提示词,难以出现完全相同的两张输出图片。使用者根据自己的审美个性,通过增删提示词、修改相关参数得出不同的图片并选定,完全体现出本质上是使用者在利用这个工具创作,投入了自己的智力以及独创思想,这样生成的图片受到著作权的保护。法律适用方面,依据《中华人民共和国著作权法》第三条和《中华人民共和国著作权法实施条例》第四条的相关规定,文学、艺术和科学领域内具有独创性并能以一定形式表现的智力成果属于作品,绘画等以线条、色彩或者其他方式构成的有审美意义的平面或者立体的造型艺术作品属于美术作品。案例中该人工智能软件生成的图片应由使用者享有著作权。
2025-03-21
用扣子提取视频文案时,显示“无权限获取该视频内容”
很抱歉,对于您使用扣子提取视频文案时显示“无权限获取该视频内容”的问题,目前知识库中没有相关的具体内容和解决方案。可能是以下原因导致的: 1. 视频所有者设置了访问权限限制,不允许第三方工具提取文案。 2. 您使用的扣子工具自身的权限设置存在问题。 3. 您在操作过程中可能未满足某些必要的条件或步骤。 建议您检查相关权限设置,确认是否符合工具的使用要求,并查看操作流程是否正确。
2025-03-21
什么是agent?什么是workflow?他们的区别和界限
智能体(Agent)和工作流(Workflow)的定义及区别如下: 智能体(Agent): 可以有多种定义。一些客户将其定义为能够长期独立运行的全自动系统,可使用各种工具完成复杂任务。 在 Anthropic 中,智能体是由 LLM 动态指导自身流程和工具使用的系统,能够自主控制任务完成方式。 工作流(Workflow): 是通过预定义代码路径来编排 LLM 和工具的系统。 每个组块可以看成是一个函数,其中混杂了传统函数、调用第三方服务的函数和基于 LLM 的函数。 总的来说,智能体更强调 LLM 对自身流程和工具使用的动态指导和自主控制,而工作流则更侧重于通过预定义的代码路径来编排 LLM 和工具。
2025-03-21
推荐网内有关DeepSeek知识
以下是为您推荐的有关 DeepSeek 的知识: 微博上热搜,主流媒体全报道。 通往 AGI 之路:关于 DeepSeek 的所有事情【知识库持续更新中】,链接:https://mp.weixin.qq.com/s/n0WrrJL0fVX6zLeTBWpZXA 数字生命卡兹克:DeepSeek 的提示词技巧,就是没有技巧,链接:https://zhuanlan.zhihu.com/p/20544736305(错误) 宝玉:教你如何破解 DeepSeek R1 系统提示词,类型:提示词破解,链接:https://mp.weixin.qq.com/s/vAp2wI5ozTw7R6jreLMw 橘子汽水铺:中国开源,震撼世界:DeepSeek R1 的变革、启示与展望,类型:基础认知,链接:https://mp.weixin.qq.com/s/yGUgehbxKisVaHlOkxhuaw 橘子汽水铺:自学成才之路,DeepSeek R1 论文解读,类型:基础认知,链接:https://mp.weixin.qq.com/s/gmdHyh6fsUdj1JhM1sV9bg 新智元:史上首次,DeepSeek 登顶中美 AppStore!NYU 教授:全球「AI 霸权」之争已结束,类型:基础认知,链接:https://mp.weixin.qq.com/s/ybvV8RMX0yyS5YfG1qNWgg 一支烟花 AI:用流程图对比 DeepSeekR1,OpenAI O1,Claude 说明强化学习在 AI 大模型训练、推理的创新和意义,类型:基础认知,链接:https://mp.weixin.qq.com/s/mdGtOcg1RuQOEBn31KhxQ 腾讯科技:一文读懂|DeepSeek 新模型大揭秘,为何它能震动全球 AI 圈,类型:基础认知,链接:https://mp.weixin.qq.com/s/cp4rQx09wygE9uHBadI7RA 张小珺腾讯科技:一场关于 DeepSeek 的高质量闭门会:比技术更重要的是愿景,类型:进阶思考,链接:https://mp.weixin.qq.com/s/a7C5NjHbMGh2CLYk1bhfYw 此外,在《雪梅 May 的 AI 学习日记》中也有相关内容,如: 学习材料: 还有 1 月 30 日社区动态速览中的《》,详细讲述了 DeepSeek 相关的基本术语、省钱原因、蒸馏工作原理等。
2025-03-21