Navigate to WaytoAGI Wiki →
Home/Question List/Question Detail

如何利用AI来打造自己的知识库?需要利用哪些软件?

Answer

以下是利用 AI 打造自己知识库的一些方法和可能用到的软件:

  1. 飞书软件:例如“通往 AGI 之路”就是一个使用飞书搭建的 AI 知识库。您可以在飞书大群中与机器人对话获取资料。
  2. Coze:在“大圣:胎教级教程:万字长文带你使用 Coze 打造企业级知识库”中有相关介绍,能帮助您理解 AI 时代的知识库,包括其概念、实现原理和能力边界等。
  3. AnythingLLM:包含所有 Open WebUI 的能力,额外支持选择文本嵌入模型和向量数据库。安装地址为 https://useanything.com/download 。安装完成后可进行配置,包括选择大模型、文本嵌入模型和向量数据库。在 AnythingLLM 中可创建独有的 Workspace 来构建本地知识库,包括创建工作空间、上传文档并进行文本嵌入、选择对话模式(Chat 模式和 Query 模式),配置完成后可进行测试对话。
  4. GPT:通过将文本拆分成小文本块并转换为 embeddings 向量,保存在向量储存库中作为问答的知识库。当用户提问时,将问题转换为向量并与储存库中的向量比对,提取关联度高的文本块与问题组合成新的 prompt 发送给 GPT API 。

希望以上信息对您有所帮助。

Content generated by AI large model, please carefully verify (powered by aily)

References

这可能是讲 Coze 的知识库最通俗易懂的文章了

大家好,我是大圣,一个致力于使用AI技术将自己打造为超级个体的程序员。对于知识库大家并不陌生,一系列的信息和知识聚集在一起就可以构成知识库。比如我最心爱的[通往AGI之路](https://waytoagi.feishu.cn/wiki/QPe5w5g7UisbEkkow8XcDmOpn8e)就是一个使用飞书软件搭建的AI知识库。当你需要了解AI某一领域知识的时候,你只需要在AGI的飞书大群中,跟机器人对话就能获取对应的资料。而在我的[大圣:胎教级教程:万字长文带你使用Coze打造企业级知识库](https://waytoagi.feishu.cn/wiki/CT3UwDM8OiVmOOkohPbcV3JCndb)也是以AI时代的知识库作为例子进行了讲解。这篇文章的目的就是帮助非编程人士来理解AI时代的知识库,读完本文你会收获:1.AI时代的知识库的概念、实现原理以及能力边界2.通往AGI之路大群中的通过对话就能获取知识库中资料的原理3.更好的使用Coze等AI Agent平台中的知识库组件,打造更加强大的智能体请允许我自卖自夸:我这篇文章可以说是知识库文章中Coze讲的最好的,讲Coze的文章中知识库讲的最好的。另外做个预告,我正在规划一个关于AI时代你应该具备的编程基础系列,大纲如下:数据库|让Coze拥有了记忆的组件1知识库|让Coze拥有了记忆的组件2变量|让Coze拥有了记忆的组件3JSON|让你更好的使用Coze插件API|外部应用程序该如何接入Coze操作系统与服务器|那些接入了Coze的微机器人都是运行在哪里的Docker|让你用最简单的方式部署微信机器人

手把手教你本地部署大模型以及搭建个人知识库

如果想要对知识库进行更加灵活的掌控,我们需要一个额外的软件:AnythingLLM。这个软件包含了所有Open WebUI的能力,并且额外支持了以下能力选择文本嵌入模型选择向量数据库[heading2]AnythingLLM安装和配置[content]安装地址:https://useanything.com/download当我们安装完成之后,会进入到其配置页面,这里面主要分为三步1.第一步:选择大模型1.第二步:选择文本嵌入模型1.第三步:选择向量数据库[heading2]构建本地知识库[content]AnythingLLM中有一个Workspace的概念,我们可以创建自己独有的Workspace跟其他的项目数据进行隔离。1.首先创建一个工作空间1.上传文档并且在工作空间中进行文本嵌入1.选择对话模式AnythingLLM提供了两种对话模式:Chat模式:大模型会根据自己的训练数据和我们上传的文档数据综合给出答案Query模式:大模型仅仅会依靠文档中的数据给出答案1.测试对话当上述配置完成之后,我们就可以跟大模型进行对话了[heading1]六、写在最后[content]我非常推崇的一句话送给大家:看十遍不如实操一遍,实操十遍不如分享一遍如果你也对AI Agent技术感兴趣,可以联系我或者加我的免费知识星球(备注AGI知识库)

从零开始,用GPT打造个人知识库

上面将文本转换成向量(一串数字)能大大节省空间,它不是压缩,可简单理解为索引(Index)。接下来就有意思了。比如我有一个大文本,可以先把它拆分成若干个小文本块(也叫chunk),通过embeddings API将小文本块转换成embeddings向量,这个向量是跟文本块的语义相关。在一个地方(向量储存库)中保存这些embeddings向量和文本块,作为问答的知识库。当用户提出一个问题时,该问题先通过embeddings API转换成问题向量,然后将这问题向量与向量储存库的所有文本块向量比对,查找距离最小的几个向量,把这几个向量对应的文本块提取出来,与原有问题组合成为新的prompt(问题/提示词),发送给GPT API。这样一来就不用一次会话中输入所有领域知识,而是输入了关联度最高的部分知识。一图胜千言,转一张原理图。再举一个极其简单的例子,比如有一篇万字长文,拆分成Chrunks包含:文本块1:本文作者:越山。xxxx。文本块2:公众号越山集的介绍:传播效率方法,分享AI应用,陪伴彼此在成长路上,共同前行。文本块3:《反脆弱》作者塔勒布xxxx。文本块4:“科技爱好者周刊”主编阮一峰会记录每周值得分享的科技内容,周五发布。...文本块n如果提问是”此文作者是谁?“。可以直观的看出上面的文本块1跟这个问题的关联度最高,文本块3次之。通过比较embeddings向量也可以得到这结论。那最后发送给GPT API的问题会类似于”此文作者是谁?从以下信息中获取答案:本文作者:越山。xxxx。《反脆弱》作者塔勒布xxxx。“这样一来,大语言大概率能回答上这个问题。

Others are asking
请推荐1~2款适合初学者的AI编程助手和编程学习工具
以下是 1 2 款适合初学者的 AI 编程助手和编程学习工具: v0:适合初学者,能为编程提供一定的辅助和支持。 Bolt:对新手友好,有助于初学者在编程过程中获得帮助和指导。 此外,还有一些其他常见的适合初学者的工具,如 GitHub Copilot,它支持多种语言和 IDE,能为程序员快速提供代码建议;通义灵码,提供行级/函数级实时续写、自然语言生成代码等多种能力。您可以根据自己的需求选择最适合您的工具。
2025-03-18
有什么ai根据脚本完成鼠标键盘的自动化操作的学习吗
GPT4VAct 是一个多模态 AI 助手,能够模拟通过鼠标和键盘进行网页浏览。 应用场景:基于 AI 的能力、项目目标人群和服务内容类型,可用于以后互联网项目产品的原型设计自动化生成,使生成效果更符合用户使用习惯,同时优化广告位的出现位置、时机和频率。 技术类型:AI 学习模型 简介:它可以模拟人类浏览网页时的行为,如点击链接、填写表单、滚动页面等。通过视觉理解技术识别网页上的元素,像人眼一样“看到”按钮、文本框、图片等,并理解其功能和用途。目的是让 AI 自动完成一些人工操作任务,提高工作效率,方便人们使用网页界面。 主要特点: 1. 视觉处理:能够处理视觉信息,但支持程度有限。 2. 自动标记:使用 JS DOM 自动标记器为 UI 元素分配数字 ID,支持 COCO 数据格式的导出。 3. 鼠标和键盘操作:能够执行点击和输入字符操作。 4. 特殊键码输入:目前不支持输入特殊键码(如回车、页面上移、页面下移)。 5. 其他功能:滚动、提示用户提供更多信息、记住与任务相关的信息等功能尚未支持。 工作原理:GPT
2025-03-18
想转型AI产品经理,推荐学习的资料有?
以下是为您推荐的学习资料,有助于您从产品经理转型为 AI 产品经理: 1. 林粒粒呀的相关视频,如“小白如何理解技术原理与建立框架”,其中介绍了思维链、RAG、PAL、ReAct 等概念,并且提到 Transformer 是仿生算法的阶段性实现。 思维链:谷歌在 2022 年一篇论文提到思维链可以显著提升大语言模型在复杂推理的能力,即使不用小样本提示,也可以在问题后面加一句【请你分步骤思考】。 RAG:检索增强生成(RetrievalAugmented Generation),外部知识库切分成段落后转成向量,存在向量数据库。用户提问并查找到向量数据库后,段落信息会和原本的问题一块传给 AI,可搭建企业知识库和个人知识库。 PAL:程序辅助语言模型(ProgramAided Language Model),2022 年一篇论文中提出,对于语言模型的计算问题,核心在于不让 AI 直接生成计算结果,而是借助其他工具比如 Python 解释器作为计算工具。 ReAct:2022 年一篇《React:在语言模型中协同推理与行动》的论文提出了 ReAct 框架,即 reason 与 action 结合,核心在于让模型动态推理并采取行动与外界环境互动。比如用搜索引擎对关键字进行搜索,观察行动得到的结果。可借助 LangChain 等框架简化构建流程。 2. 余一的相关内容,如《AI 时代个人生存/摸鱼探索指南.Beta》《从 2023 年报,看中国上市公司怎么使用生成式 AI》。 3. 相关网页链接: 创新公司观察: 2022 2024 年融资 2000w 美金以上的公司列表和详细公司分析:https://ameliadev.notion.site/202220242000w08f50fafd81b420fa7f26ecd6c0b3243?pvs=4 AI Grant 公司列表和详细公司分析(三期):https://ameliadev.notion.site/AIGranta52f291e81f34b418c9919497961e831?pvs=4 AIGC 行业与商业观察(2024.1):https://gamma.app/docs/AIGCDev9q1bax2pspnlxqu 【AI 产品/功能构建】: 顶级科技公司产品团队正在构建哪些 AI 功能【总览】:https://gamma.app/docs/AIzawqmb2ff3cv958 顶级科技公司产品团队正在构建哪些 AI 功能【产品分析】:https://gamma.app/docs/AItebxqet8ubz3rje 顶级科技公司产品团队正在构建哪些 AI 功能【思考借鉴】
2025-03-18
有什么使用AI驱动的游戏项目吗?其中有哪些比较热门
以下是一些使用 AI 驱动的游戏项目及热门情况: 1. 《Among Us》:由只有 5 名员工的工作室 Innersloth 制作。 2. 《微软模拟飞行》:有新的游戏类型和与新内容实时生成结合的特点。 3. 《AI Dungeon》和《Hidden Door》:基于文本的早期游戏例子。 4. 《Suck Up!》:2023 年 12 月由 Proxima 工作室开发的“喜剧欺骗游戏”,玩家扮演吸血鬼与 LLM 驱动的 NPC 对话,上线仅两周全网播放火速突破千万。 此外,还有以下趋势和特点: 1. 由人工智能辅助的“微型游戏工作室”逐步崛起,小型工作室能创造的游戏规模将增长。 2. 每年发布的游戏数量会增加。 3. 新的游戏类型将会被创造出来,例如以人工智能创造的角色为特色的 Spellbrush 的 RPG 游戏 Arrowmancer。 4. 有的游戏开发商使用人工智能让玩家在游戏中创建自己的头像。 生成式 AI 将使生产高质量游戏变得更加简单、更快和更便宜,同时使玩家能够真正定制他们的游戏体验。我们已经看到像 Scenario、Iliad 这样可以创建游戏资源的 AI 工具,以及像 Promethean 这样可以构建整个虚拟世界的平台。甚至可以用像 Inworld、Charisma 和 Convai 这样的产品生成非玩家角色(NPC)。
2025-03-18
有没有适合记录会议纪要的AI
以下是一些适合记录会议纪要的 AI 工具和方法: 1. 案例一:【普通人秒变效率王】AI 工作流秒记会议纪要 视频讲解:https://m.okjike.com/originalPosts/65fa9d1112ed2fda68e6215e?s=eyJ1IjoiNTlhZDcyZDUwYjAyYTEwMDEyMjc3YmZmIiwiZCI6MX0%3D 工作流概述: 文本导出:使用飞书妙记将会议对话导出为 txt 文件 纪要生成:启动 Kimichat 输入会议纪要 prompt 提示词并上传 txt 文件 内容完善:与 Kimichat 对话并补充会议中未记录或需强调的信息 纪要微调:审阅 Kimichat 生成的会议纪要草稿进行必要微调 成品输出:确认会议纪要内容无误后,输出最终版文档 和 Kimichat 的完整对话(点击可直接复用并接着聊):https://kimi.moonshot.cn/share/cnsk08phmfr6s04umlrg 2. 总结类 AI 工具: 3. 免费的会议语音转文字工具: 飞书妙记:https://www.feishu.cn/product/minutes ,飞书的办公套件之一 通义听悟:https://tingwu.aliyun.com/home ,阿里推出的 AI 会议转录工具 讯飞听见:https://www.iflyrec.com/ ,讯飞旗下智慧办公服务平台 Otter AI:https://otter.ai/ ,转录采访和会议纪要 更多会议记录工具请访问网站:https://waytoagi.com/sites/category/29 。请注意,内容由 AI 大模型生成,请仔细甄别。
2025-03-18
我自己想做一个英语背单词的游戏,让AI写出Markdown代码运行后,发现问题很大,但是我有不知如何修改这些代码。所以我觉得自己应该懂Markdown 代码语言。但是我不知道Markdown是最适合的编程语言吗?
Markdown 语言不太适合用于编写复杂的英语背单词游戏。虽然 Markdown 简单易用,常用于文档格式化,但在实现游戏逻辑和功能方面存在较大局限性。 如果您想开发英语背单词游戏,更适合使用编程语言,如 Python 等。在处理代码问题时,您可以参考以下方法: 1. 对于编程小白,向 AI 提供代码范例,尤其是新进入代码节点的 IDE 中的范例,减少对 AI 所写代码的改动。 2. 向 AI 说清楚输入变量与输出变量的类型。 3. 说明与工作流中匹配或想要的变量名称,以减少二次修改。 4. 列出输入变量的具体书写形式,对于复杂形式可使用特定方法获取。 5. 说清楚代码要实现的功能,复杂功能尽量将运行逻辑描述清楚,多用变量名称指代涉及的变量。 如果代码运行效果不尽人意,可把当前的代码、输入变量、预期结果提供给 AI,并告知错误的结果或者报错信息,让 AI 帮忙寻找问题并提供修改方案。提问时可参考以下方式: 以上是我目前的 python 代码,我的输入变量。 但是代码运行后的实际结果却是。 另外,在游戏开发与修改过程中,还需注意文件的存放要求、功能优化、平台上传等方面的问题。例如,三个重要文件需在一个文件夹,本地内置图像、音乐等也需在同一文件夹。游戏功能可增加关卡、调整金币获取和技能点花费、解决 Bug 等。研究将游戏发布到 4399 开放平台时,需注册、实名制,审核较严格。获取游戏素材可从官网免费下载或淘宝购买抠好的素材。
2025-03-18
请问哪个平台支持上传私人知识库文件
以下平台支持上传私人知识库文件: 本地文档: 文本内容: 支持格式:.txt、.pdf、.docx。 操作步骤:在文本格式页签下选择本地文档,然后单击下一步。将要上传的文档拖拽到上传区,或单击上传区域选择要上传的文档。每个文件不得大于 20M,一次最多可上传 10 个文件。上传完成后选择内容分段方式,包括自动分段与清洗(系统会对上传的文件数据进行自动分段,并会按照系统默认的预处理规则处理数据)和自定义(手动设置分段规则和预处理规则,包括选择分段标识符、设置分段最大长度、设置文本预处理规则,如替换掉连续的空格、换行符和制表符,删除所有 URL 和电子邮箱地址),最后单击下一步完成内容上传和分片。 表格数据: 支持格式:.csv 和.xlsx。 操作步骤:在表格格式页签下选择本地文档,然后单击下一步。将要上传的文档拖拽到上传区,或单击上传区域选择要上传的文档,然后单击下一步。每个文件不得大于 20M,一次最多可上传 10 个文件。配置数据表信息,包括指定数据范围(通过选择数据表、表头、数据起始行指定数据范围)、确认表结构(系统已默认获取表头的列名,可自定义修改列名或删除某一列名)、指定语义匹配字段(选择作为搜索匹配的语义字段)。查看表结构和数据,确认无误后单击下一步,完成上传后单击确定。 Notion: 操作步骤:在文本格式页签下选择 Notion,然后单击下一步。单击授权,首次导入 Notion 数据和页面时需要进行授权。在弹出的页面完成登录,并选择要导入的页面。选择要导入的数据,然后单击下一步。选择内容分段方式,包括自动分段与清洗和自定义,最后单击下一步完成内容上传和分片。 自定义: 操作步骤:在文本格式页签下选择自定义,然后单击下一步。输入单元名称,然后单击确认。单击创建分段,然后在弹出的页面输入要上传的内容。每个分段最多可添加 2000 个字符。单击保存。
2025-03-18
知识库搭建注意事项
以下是关于知识库搭建的注意事项: 1. 数据清洗方式: 可选择手动清洗数据以提高准确性,避免自动清洗数据可能出现的不准确情况。 对于本地文档,要注意合理拆分内容以提高训练数据准确度,不能将所有内容一股脑放入训练。 2. 在线知识库: 点击创建知识库,可创建如画小二课程的 FAQ 知识库。 飞书在线文档中每个问题和答案以分割,可点击编辑修改和删除。 选择飞书文档,选择自定义的自定义,输入。 点击添加 Bot 并在调试区测试效果。 3. 本地文档: 对于本地 word 文件,要注意拆分内容的方法。例如,对于画小二课程,将 80 节课程分为 11 个章节,先放入大章节名称内容,再按固定方式细化章节内详细内容。 选择创建知识库自定义清洗数据。 4. 发布应用: 点击发布,确保在 Bot 商店中能够搜到,否则无法获取 API。 5. 文档格式和分片策略: 以创建外贸大师产品的帮助文档知识库为例,可选择使用 Local doucuments 方式上传 Markdown 格式文档,每个问题以开头。 文档的分片策略会严重影响查询结果,RAG 方案存在跨分片总结和推理能力弱、文档有序性被打破、表格解析失败等缺点。 此外,在信息管理和知识体系搭建中,“拎得清、看得到、想得起、用得上”是四个核心步骤: 1. 拎得清:主动选择和判断高质量、与目标相关的信息源,利用 AI 搜索引擎筛选信息,加入优质社群、订阅号等建立信息通路。 2. 看得到:确保所选信息能频繁且不经意地触达个人,通过浏览器插件、笔记工具等组织信息,使其易于检索和浏览。 3. 想得起:做好信息的索引和关联,存储时做好标记(关键词、tag)、选择合适存放位置,推荐使用 PARA 笔记法等方法组织串联信息。 4. 用得上:将积累的知识转化为实际行动和成果,在解决问题或创造价值时从知识库中调取相应信息。
2025-03-17
知识库
以下是关于知识库的相关内容: 智能体创建: 手动清洗数据:本次创建知识库使用手动清洗数据,上节课程是自动清洗数据,自动清洗数据可能出现数据不准的情况,手动清洗可提高数据准确性。参考课程:。 在线知识库:点击创建知识库,创建画小二课程的 FAQ 知识库。飞书在线文档中每个问题和答案以分割,可选择飞书文档、自定义的自定义,输入后可区分内容,还可编辑修改和删除,添加 Bot 后可在调试区测试效果。 本地文档:对于本地 word 文件,注意拆分内容以提高训练数据准确度。例如画小二 80 节课程分为 11 个章节,不能一股脑全部放入训练,应先放入大章节名称内容,章节内详细内容按固定方式人工标注和处理,然后选择创建知识库自定义清洗数据。 发布应用:点击发布,确保在 Bot 商店中能搜到,否则无法获取 API。 概述: 扣子提供了几种存储和记忆外部数据的方式,以便 Bot 精准回复用户。知识库是大量知识分片,通过语义匹配为模型补充知识,以车型数据为例,每个知识库分段保存一种车型基础数据。同时还介绍了数据库、AI 便签、单词本等。 智能体“竖起耳朵听”: 扣子的知识库功能强大,可上传和存储外部知识内容,提供多种查找知识的方法,解决大模型有时出现的幻觉或专业领域知识不足的问题。在该智能体中使用了自己的知识库,收集了很多地道口语表达的短句,知识库可包含多种格式文件,此例中只用了文本格式,智能体回答用户时会先检索知识库内容。还可添加开场白提升体验。
2025-03-16
我需要搭建一个每个人都能使用的知识库
要搭建一个每个人都能使用的知识库,可以考虑使用 GPT 并借助 embeddings 技术。以下是相关步骤和原理: 1. 文本处理:将大文本拆分成若干小文本块(chunk)。 2. 向量转换:通过 embeddings API 将小文本块转换成与语义相关的 embeddings 向量,并在向量储存库中保存这些向量和文本块,作为问答的知识库。 3. 问题处理:当用户提出问题时,先将问题通过 embeddings API 转换成问题向量,然后与向量储存库中的所有文本块向量进行比对,查找距离最小的几个向量,提取对应的文本块,并与原有问题组合成新的 prompt 发送给 GPT API。 4. 容量限制:GPT3.5 一次交互支持的 Token 数量有限,embedding API 是解决处理大量领域知识的方案。 5. 理解 embeddings:embeddings 是浮点数字的向量,向量之间的距离衡量关联性,小距离表示高关联度。例如,“猫”和“狗”距离近,与“汽车”距离远。 例如,对于一篇万字长文,拆分成的 chunks 包含:文本块 1:本文作者:越山。xxxx。文本块 2:公众号越山集的介绍:传播效率方法,分享 AI 应用,陪伴彼此在成长路上,共同前行。文本块 3:《反脆弱》作者塔勒布xxxx。文本块 4:“科技爱好者周刊”主编阮一峰会记录每周值得分享的科技内容,周五发布。如果提问是“此文作者是谁?”,通过比较 embeddings 向量,可以直观地看出文本块 1 跟这个问题的关联度最高,文本块 3 次之。最后发送给 GPT API 的问题会类似于“此文作者是谁?从以下信息中获取答案:本文作者:越山。xxxx。《反脆弱》作者塔勒布xxxx。”这样大语言模型大概率能回答上这个问题。
2025-03-16
我想建立一个知识库,自动生成解决方案
以下是关于建立知识库并自动生成解决方案的相关信息: smartBot 的应用场景: 1. 辅助使用者对某个行业/领域/问题进行深度解读和分析,并建立系统性的认知过程。 2. 根据预设流程,自动化形成对某个专业方向/领域/行业的系统化知识图谱。 基于知识图谱的问答系统: 1. 结合知识图谱中的丰富信息,能够提供精确且富有洞察力的答案,无论问题是关于具体事实还是复杂关系。 2. 以 Bilibili 知识区为核心,将分散的知识点整合成语义网络,涵盖广泛主题领域,揭示不同概念间潜在关系。 3. 对 Bilibili 知识区重点视频字幕进行数据清洗和分词处理,确保数据准确性和一致性。 4. 利用 NLP 技术解析和优化用户查询,自动补充或纠正模糊查询词,提高查询准确性和覆盖面。 5. 采用先进深度学习技术,对用户查询进行深入语义理解和上下文分析,提供更精准搜索结果。 知识库构建与业务完整性: 1. 从文档切片、向量化到数据入库,构建完整的知识库。 2. 结合检索模块和生成模块,提供从检索到生成的完整解决方案。 用 Coze 免费打造微信 AI 机器人的步骤: 1. 设计方面:确定功能范围。 2. 搭建步骤: 开始节点和结束节点由 coze 自动生成。 开始节点配置:输入变量名写“Question”,描述写“用户输入的问题”,变量类型选“String”。 知识库配置:将开始节点和知识库左侧节点连接,引用开始节点的变量“Question”,添加创建好的知识库,并将知识库右侧节点与结束节点左侧连接。 结束节点配置:用于输出 AI 机器人的最终结果,回答格式设置为“您的问题:{{question}} 问题的答案:{{answer}}”,定义“question”引用“开始节点的 Question”,“answer”引用“知识库节点的输出 output”,选择使用设定内容直接回答。 试运行测试:点击右上角“试运行”,输入问题后点击“运行”,查看工作流每一步的详细输入和输出。
2025-03-16
如何建立自己的知识库
要建立自己的知识库,可以参考以下两种方法: 方法一:用 GPT 打造个人知识库 1. 理解 embeddings:embeddings 是一个浮点数字的向量(列表),两个向量之间的距离衡量它们的关联性,小距离表示高关联度,大距离表示低关联度。向量是数学中表示大小和方向的一个量,通常用一串数字表示,在计算机科学和数据科学中,向量通常用列表来表示。向量之间的距离是一种度量两个向量相似性的方法,最常见的是欧几里得距离。在 OpenAI 词嵌入中,靠近向量的词语在语义上相似。 2. 使用 embeddings:将大文本拆分成若干个小文本块(chunk),通过 embeddings API 将小文本块转换成 embeddings 向量,在一个地方(向量储存库)中保存这些 embeddings 向量和文本块,作为问答的知识库。当用户提出一个问题时,该问题先通过 embeddings API 转换成问题向量,然后将这问题向量与向量储存库的所有文本块向量比对,查找距离最小的几个向量,把这几个向量对应的文本块提取出来,与原有问题组合成为新的 prompt(问题/提示词),发送给 GPT API。 方法二:用 Coze 免费打造自己的微信 AI 机器人 1. 设计您的 AI 机器人。 2. 确定功能范围。 3. 创建知识库:整理“关键字”与“AI 相关资料链接”的对应关系,并将信息存储起来。创建知识库路径为个人空间 知识库 创建知识库。知识库文档类型支持本地文档、在线数据、飞书文档、Notion 等,本次使用【本地文档】。按照操作指引上传文档、分段设置、确认数据处理。小技巧:知识库好不好用,跟内容切分粒度有很大关系,我们可以在内容中加上一些特殊分割符,比如“”,以便于自动切分数据。分段标识符号要选择“自定义”,内容填“”。最终的知识库结果中,同一颜色代表同一个数据段,如果内容有误需要编辑,可以点击具体内容,鼠标右键会看到“编辑”和“删除”按钮,可以编辑或删除。
2025-03-16
我如果想利用ai实现商业应用,请问我应该从什么开始学习
如果您想利用 AI 实现商业应用,可以从以下方面开始学习: 1. 微软相关课程: 《面向商业用户的人工智能学习》:https://learn.microsoft.com/enus/training/paths/introductionaiforbusinessusers/?WT.mc_id=academic77998cacaste 《人工智能商学院》:https://learn.microsoft.com/enus/training/paths/transformyourbusinesswithmicrosoftai/ (和欧洲工商管理学院 INSEAD 共同开发) 《机器学习入门课程》:https://github.com/Microsoft/MLforBeginners 《视觉》:https://learn.microsoft.com/enus/training/paths/createcomputervisionsolutionsazureai/?WT.mc_id=academic77998cacaste 《自然语言处理》:https://learn.microsoft.com/enus/training/paths/explorenaturallanguageprocessing/?WT.mc_id=academic77998cacaste 《使用 Azure OpenAI 服务的生成式人工智能》:https://learn.microsoft.com/enus/training/paths/developaisolutionsazureopenai/?WT.mc_id=academic77998bethanycheum 2. 清华创协独立开发的 AI 应用开发实训营: 活动主题:以独立开发模式做可商业化的 AI 应用,从零到一打造具有商业化潜力的 AI 应用,学习产品设计、应用开发、运营与增长,并产出至少一个具备商业化潜力的 AI 应用。 课程亮点:实战为王,项目驱动,采用“理论认知+动手实践”双轨模式,在真实项目中积累经验;专业导师,深度指导,邀请独立开发者、资深工程师、产品经理提供指导与建议;资源支持,助你腾飞,提供 API、算力等资源支持,降低开发成本。 课程框架:暂未详细说明。 3. 了解七大行业的商业化应用: 企业运营:包括日常办公文档材料撰写整理、营销对话机器人、市场分析、销售策略咨询、法律文书起草等。 教育:协助评估学生学习情况、定制化学习内容、论文相关工作等。 游戏/媒体:如定制化游戏、动态生成 NPC 互动等。 零售/电商:包括舆情监测、品牌营销、库存管理等。 金融/保险:如个人金融理财顾问、欺诈活动风险检测等。 制造业/汽车:涵盖生产计划、产线预测性维保辅助等。 生命科学:包括研发阶段靶点发现、医学文献处理等。 此外,ChatGPT 大模型以及生成式 AI 技术还将在图片、视频、数字人等领域的各种复杂场景中落地,利用海量的数据资源和算法实现商业化应用与迭代更新。
2025-03-15
我想写一篇本科生论文,利用ai工具来帮我更好完善,需要用到那些常用指令
在本科生论文写作中,以下是一些常用的 AI 指令和相关工具: 1. 内容生成和辅助写作: 指令示例:“根据以下关于我的信息,写一篇四段的大学申请论文:我来自西班牙巴塞罗那。尽管我的童年经历了一些创伤性事件,比如我 6 岁时父亲去世,但我仍然认为我有一个相当快乐的童年。在我的童年时期,我经常换学校,从公立学校到非常宗教的私立学校。我做过的最‘异国情调’的事情之一是在爱达荷州的双子瀑布与我的大家庭一起度过六年级。我很早就开始工作了。我的第一份工作是 13 岁时的英语老师。在那之后,以及在我的学习过程中,我做过老师、服务员,甚至建筑工人。” 工具:Grammarly ,通过 AI 技术提供文本校对、语法修正和写作风格建议,帮助提高论文的语言质量;Quillbot ,一个基于 AI 的重写和摘要工具,可以帮助研究人员精简和优化论文内容。 2. 文献管理和搜索: 工具:Zotero ,结合 AI 技术,可以自动提取文献信息,帮助研究人员管理和整理参考文献;Semantic Scholar ,一个由 AI 驱动的学术搜索引擎,能够提供相关的文献推荐和引用分析。 3. 研究和数据分析: 工具:Google Colab ,提供基于云的 Jupyter 笔记本环境,支持 AI 和机器学习研究,便于进行数据分析和可视化;Knitro ,一个用于数学建模和优化的软件,可以帮助研究人员进行复杂的数据分析和模型构建。 4. 论文结构和格式: 工具:LaTeX ,虽然不是纯粹的 AI 工具,但结合了自动化和模板,可以高效地处理论文格式和数学公式;Overleaf ,一个在线 LaTeX 编辑器,提供丰富的模板库和协作功能,简化论文编写过程。 5. 研究伦理和抄袭检测: 工具:Turnitin ,一个广泛使用的抄袭检测工具,帮助确保论文的原创性;Crossref Similarity Check ,通过与已发表作品的比较,检测潜在的抄袭问题。 需要注意的是,使用这些 AI 工具时,要结合自己的写作风格和需求,选择最合适的辅助工具,同时要确保使用方式符合学术道德和规范。
2025-03-15
我没有编程专业知识,想学如何利用AI做软件开发
如果您没有编程专业知识但想利用 AI 做软件开发,以下是一些建议和相关信息: 在软件开发方面,AI 辅助编程工具如 Cursor、Windsurf 可帮助您解决编程问题。面试时,可观察候选人如何向 AI 提问、判断 AI 代码的正确性以及调整 AI 生成的代码。 例如 Trae 这样的 AI 编程神器,能高效生成代码,支持多技术栈,且具有动态调整的潜力。如生成任务清单应用和根据 UI 设计图自动生成项目代码,但可能存在一些不完善之处,可继续让其调整。 利用固定格式文档结合 AI 进行代码开发具有一定可行性,但需强调组员主观能动性,文档并非唯一最佳方式,可尝试简短描述或 Prompt 辅助代码生成。 对于后端 Java 程序员转向 LLM 方向,可借助 AI 编程工具熟悉 LLM 原理,开展相关 Side Project,将 AI 当老师边做边学,坚持使用 AI 辅助编程。 相关链接:
2025-03-13
如何利用aigc生成高质量的logo?
利用 AIGC 生成高质量的 logo 可以参考以下方法: 1. 在 AIGC 1.0 时代,AIGC 主要起到产生参考图像的作用,可使用 ControlNet 但存在一定局限性,如无法精确控制某些特征材质,不过适合整体全身材质风格替换,能以正视图或手绘线稿图输入 ControlNet 进行控制。 2. 在 AIGC 2.0 时代,基于 Stable diffusion 的 Lora 模型训练可直出较高质量的形象,但对于要求较高的场景仍存在问题,如四肢比例失调、手指数量错误等,随着技术更新有望解决。 3. 可以使用 Midjourney 等生成式 AI 工具为企业创建徽标,将相关提示与企业信息结合,制作适合自身品牌个性和价值观的定制徽标,提示种类丰富并提供设计样例。 同时需要注意,目前的 AIGC 工具仍存在问题,真正的完美落地仍需要专业设计师的大量介入与修复。拥抱 AIGC 是为设计师提供辅助工具,而非完全取代传统设计方法或设计师。
2025-03-13
如何利用人工智能破解无人机通信协议
目前没有关于如何利用人工智能破解无人机通信协议的相关内容。破解无人机通信协议是不合法且不符合道德规范的行为,可能会导致严重的法律后果。在合法和合规的前提下,人工智能可以用于优化无人机的通信效率、增强通信安全性等方面。
2025-03-13
我是一名短视频创作者,我自身有自己写的现代诗歌,但是因为自己的声音不好,所以想自己制作一个利用网络音频和AI视频来展示我创作的诗歌的coze工作流,但是我对于ai的提示词有很多不明白的地方,您能够给我帮助吗
以下是为您提供的关于利用网络音频和 AI 视频展示诗歌的 Coze 工作流的相关指导: 1. 整体结构和参数配置: 工作流通常包括开始模块、Get_Video 模块、LinkReaderPlugin 模块、标题大模型、内容大模型、图片 Prompt 大模型、文生图 ImageToolPro 模块和输出结果模块等。 每个模块都有其特定的参数配置,例如在开始模块中选择源语言和目标语言等。 2. 标题大模型参数配置: 您需要作为小红书爆款写作专家,根据输入内容产出 3 个标题,采用二极管标题法创作,并善于使用吸引人的特点和爆款关键词,同时要符合小红书平台的标题特性和创作规则。 3. 内容大模型参数配置: 作为小红书爆款写作专家,根据输入内容产出 1 篇正文,每段话包含适当的 emoji 表情,文末有合适的 tag 标签。写作时要注意风格、开篇方法、文本结构、互动引导方法、一些小技巧、爆炸词等,文章尽量口语化、简短,在 200 字左右。 4. 图片 Prompt 大模型参数配置: 作为绘图 Prompt 大师,将输入内容转成 AI 更容易理解的绘画 Prompt。 5. 工作流创建步骤: 点击工作流后面的“+”添加工作流,然后创建工作流。 给工作流起名字和描述,名字只能用字母、数字和下划线,描述要清晰。 初始化工作流后,会生成开始模块和结束模块,左边有各种插件和搭建 Agent 的工具,可根据需要添加和使用。 希望以上内容对您有所帮助,如果您在具体操作过程中还有其他疑问,请随时向我咨询。
2025-03-12
目前有哪些免费可用的 AI视频生成软件
以下是一些免费可用的 AI 视频生成软件: 1. Haiper:有免费额度,网址为 https://haiper.ai/ 。支持文生视频、图生视频、素描生视频、扩展视频,能生成 HD 超高清的视频。文生视频支持选择风格、秒数(2s 和 4s)、种子值。图生视频只能写提示词、秒数(2s 和 4s)。还支持视频重绘,包括局部重绘。 2. DynamiCrafter:免费,网址为 https://huggingface.co/spaces/Doubiiu/DynamiCrafter 及 https://github.com/Doubiiu/DynamiCrafter?tab=readmeovfile ,可生成 2 秒图生视频,还能做短视频拼长视频。 3. Morph studio:处于内测阶段,网址为 https://app.morphstudio.com/ 。暂未对外开放,可在官网提交内测申请。在 discord 上可以免费体验,支持文生视频、图生视频,英文提示词,支持运镜、运动强度、尺寸、秒数设置,默认生成 3s 视频。 此外,清影也是一款不错的 AI 视频生成工具,在首发测试期间所有用户均可免费使用。它具有不限量使用、生成速度快、提供配乐小功能等特色。生成参数包括时长 6s、清晰度 1440x960(3:2)、帧率 16fps 等,在风景、动物、超现实、人文历史类需求以及皮克斯风格、卡通风格、摄影风格、动漫风格等方面表现突出。 截至 2023 年,我们已经发现了 21 个公开的人工智能视频生成工具,大多数起初以 Discord 机器人的形式存在,随着产品成熟,越来越多的工具开始建立自己的网站甚至开发移动应用。
2025-03-18
推荐几个配音软件
以下是为您推荐的配音软件: 免费的配音软件:剪映配音、布谷鸟配音。 付费的配音软件:讯飞配音。 此外,还有一些效果较好的配音工具: 睿声:使用门槛较低,适合新手。例如,在之前生成的分镜中,Claude 已经给出了旁白内容,我们直接把旁白内容复制到睿声语音生成功能里。首先打开睿声(https://dash.reecho.ai/),登录自己的账户后,在首页左侧选择声音社区在搜索框中输入“宣传”后搜索点击“宣传配音角色”添加到列表。接着回到首页,点击选择左侧“语音生成”把所有旁白输入到文本框 1 处2 处选择角色“宣传 8”3 处点击“添加段落”4 处选择“高质量模式”5 处选择“V2.1 均衡”6 处点击“开始生成”。需要注意的是,睿声很多时候对于和英文字母并在一起的数字的生成效果并不好,很可能会把数字以英文的形式读出来,所以可以把数字用中文汉字代替。生成完配音后点击结果右上方的三个点,选择下载,即可保存配音文件到本地,留着后面剪辑用。 微软 axure:操作方法复杂,门槛高,效果和睿声类似。 elevenlabs:有门槛,推荐老手使用。 Wavel Studio:支持 30 多种语言的配音,音质自然流畅,自动去除背景噪音和杂音,提供添加字幕和文本叠加层的工具,界面友好,提供多种自定义选项。 Elai.io:支持 65 多种语言的配音,音色和语调真实,自动将唇形与语音同步,生成字幕,提高视频的可访问性,支持多位配音者,适合复杂对话场景。 Rask AI:支持 130 多种语言的配音,包括稀有和濒危语言,采用先进语音合成技术,音质高保真,提供语音参数自定义和音效添加工具,与多种视频编辑平台和工作流程整合。 Notta:提供快速实惠的多语言配音解决方案,保留原声说话风格和细微差别,提供调整语音速度和音调的工具,支持批量处理,高效完成多视频配音。 Dubverse:支持 60 多种语言的配音,音质接近真人,提供文本转语音和语音克隆功能,提供语音参数自定义和情感添加工具,与多种视频平台和社交媒体渠道整合。 Speechify
2025-03-18
写自媒体文章,哪个AI软件好
以下是一些适合用于写自媒体文章的 AI 软件: 1. Wordvice AI:集校对、改写转述和翻译等功能于一体的 AI 写作助手,基于大型语言模型提供全面的英文论文润色服务。 2. ChatGPT:由 OpenAI 开发的大型语言模型,可用于学生和写作人员的多方面写作辅助。 3. Quillbot:人工智能文本摘要和改写工具,可用于快速筛选和改写文献资料。 4. HyperWrite:基于 AI 的写作助手和大纲生成器,可帮助用户在写作前进行头脑风暴和大纲规划。 5. Wordtune:AI 驱动的文本改写和润色工具,可以帮助用户优化文章的语言表达。 6. Smodin:提供 AI 驱动的论文撰写功能,可以根据输入生成符合要求的学术论文。 利用 AI 不到 30 分钟打造爆款公众号文章的步骤如下: 1. 收集相关资料:明确文章主题后,借助 AI 工具高效完成。例如使用 Perplexity.AI 的强大搜索功能获取信息,输入具体的 Prompt 定位相关资讯,还可使用具备联网搜索功能的工具如微软的 Bing 搜索引擎。 2. 整理资料:收集完资料后,使用月之暗面开发的 Kimi 这个 AI 会话助手进行整理。需注意 Kimi 阅读能力有限,可分批次提供资料确保其有效读取和理解。
2025-03-17
想要使用AI软件对学生成绩进行分析,请问应该用什么提示词
以下是一些关于使用提示词对学生成绩进行分析的建议: 1. 明确分析目标:例如找出成绩优秀和较差的学生特点、分析成绩的趋势等。 2. 描述数据特点:包括成绩的科目、分数范围、数据量等。 3. 确定分析方法:如比较不同时间段的成绩、按照班级或年级进行分类分析等。 4. 强调重点关注内容:比如特定学科的成绩表现、成绩波动较大的学生等。 5. 注意提示词的准确性和清晰性,避免模糊或歧义的表述。 在实际编写提示词时,可以参考以下格式:“对的表现。” 同时,不同的 AI 工具可能对提示词的要求和处理方式有所不同,您可能需要根据具体工具的特点进行适当调整。
2025-03-17
做ai音乐的经验和软件
以下是关于做 AI 音乐的经验和软件的相关内容: 经验方面: 1. 具备一定的 AI 音乐创作经验,如在 UDIO 和 SUNO 上制作过音乐。 2. 熟悉提示词(Prompt)的应用,了解如何使用 Prompt 进行创作。 3. 了解音乐编曲和结构,对编曲、歌曲结构有一定了解。 4. 掌握数字音频工作站(DAW)软件,如 Audition、Studio One 等。 5. 拥有对音乐的热爱,保持对音乐创作的热情和兴趣。 6. 在创建 AI 生成曲子的过程中,注意风格和语言的选择,以确保生成的曲子符合自己的需求。 7. 投喂给 AI 的旋律应保持清晰,避免复杂的节奏构架和变化,以提高 AI 的辨识度和创作效果。 软件方面: 1. 明天学习需要下载 flow 水果软件,可以在淘宝上购买并请人帮忙安装。 2. 可以使用 PS 里的工具进行抠图操作。 3. 利用分离人声的 AI 软件,能够将人声从背景音乐中分离出来。 4. 微软 AI 语音:制作使用了微软声音库制作旁白,语音库支持 147 种语言,还有定制声音。
2025-03-16
如何通过AI进行软件测试?有什么好用的AI工具,以及详细的步骤是什么?
以下是关于如何通过 AI 进行软件测试以及相关好用的 AI 工具和详细步骤的介绍: 一、基于规则的测试生成 1. 测试用例生成工具 Randoop:基于代码路径和规则生成测试用例,适用于 Java 应用程序。 Pex:微软开发的智能测试生成工具,自动生成高覆盖率的单元测试,适用于.NET 应用。 2. 模式识别 Clang Static Analyzer:利用静态分析技术识别代码模式和潜在缺陷,生成相应的测试用例。 Infer:Facebook 开发的静态分析工具,自动生成测试用例,帮助发现和修复潜在错误。 二、基于机器学习的测试生成 1. 深度学习模型 DeepTest:利用深度学习模型生成自动驾驶系统的测试用例,模拟不同驾驶场景,评估系统性能。 DiffTest:基于对抗生成网络(GAN)生成测试用例,检测系统的脆弱性。 2. 强化学习 RLTest:利用强化学习生成测试用例,通过与环境交互学习最优测试策略,提高测试效率和覆盖率。 A3C:基于强化学习的测试生成工具,通过策略梯度方法生成高质量测试用例。 三、基于自然语言处理(NLP)的测试生成 1. 文档驱动测试生成 Testim:AI 驱动的测试平台,通过分析文档和用户故事自动生成测试用例,减少人工编写时间。 Test.ai:利用 NLP 技术从需求文档中提取测试用例,确保测试覆盖业务需求。 2. 自动化测试脚本生成 Selenium IDE + NLP:结合 NLP 技术扩展 Selenium IDE,从自然语言描述中生成自动化测试脚本。 Cucumber:使用 Gherkin 语言编写的行为驱动开发(BDD)框架,通过解析自然语言描述生成测试用例。 四、基于模型的测试生成 1. 状态模型 GraphWalker:基于状态模型生成测试用例,适用于复杂系统的行为测试。 Spec Explorer:微软开发的模型驱动测试工具,通过探索状态模型生成测试用例。 2. 场景模拟 Modelbased Testing :基于系统模型自动生成测试用例,覆盖各种可能的操作场景和状态转换。 Tosca Testsuite:基于模型的测试工具,自动生成和执行测试用例,适用于复杂应用的端到端测试。 五、实践中的应用示例 1. Web 应用测试:使用 Testim 分析用户行为和日志数据,自动生成高覆盖率的测试用例,检测不同浏览器和设备上的兼容性问题。 2. 移动应用测试:利用 Test.ai 从需求文档中提取测试用例,确保覆盖关键功能和用户路径,提高测试效率和质量。 3. 复杂系统测试:采用 GraphWalker 基于系统状态模型生成测试用例,确保覆盖所有可能的状态和操作场景,检测系统的边界情况和异常处理能力。 六、好用的 AI 工具 Testim:AI 驱动的自动化测试平台,生成和管理测试用例。 Test.ai:基于 NLP 技术的测试用例生成工具,适用于移动应用和 Web 应用。 DeepTest:利用深度学习生成自动驾驶系统测试用例。 GraphWalker:基于状态模型生成测试用例,适用于复杂系统的行为测试。 Pex:微软开发的智能测试生成工具,自动生成高覆盖率的单元测试。 希望以上内容对您有所帮助。
2025-03-16