Navigate to WaytoAGI Wiki →
Home/Question List/Question Detail

deepseek本地部署

Answer

DeepSeek 是一个非常出色的科技成果,具有以下显著特点:

  1. 强大的推理能力,可与 O1 比肩。
  2. 价格便宜,参数少,训练开销与使用费用小了一个数量级。
  3. 开源,任何人都可自行下载与部署,并提供论文详细说明训练步骤与窍门,甚至有可运行在手机上的 mini 模型。
  4. 免费,官方目前提供的服务完全免费,任何人随时随地可用。
  5. 支持联网搜索,是暂时唯一支持联网搜索的推理模型(O1 还不支持)。
  6. 由没有海外经历甚至没有资深从业经验的本土团队开发完成。

如果您想使用 DeepSeek,可以直接访问相关网页链接马上用起来,也有移动 APP 可供选择。

另外,关于 SDXL 的本地部署,对于配置较高的电脑,如 4080ti 显卡,生成一张图的速度在十秒左右,还是可以接受的。对于配置较低的电脑,需要自行测试。如果觉得操作麻烦,还可以安装 refine 插件,在文生图的界面直接使用 refine 模型进行绘画。

Content generated by AI large model, please carefully verify (powered by aily)

References

详解:DeepSeek深度推理+联网搜索 目前断档第一

[heading3]游戏科学创始人、黑神话悟空制作人冯骥:年前还是认真推下DeepSeek吧。V3已经用了一个月,但R1仅仅用了5天,不得不来发这条微博。先讲一句暴论:DeepSeek,可能是个国运级别的科技成果。为了讲清楚这个成果有多惊人,我打个比方:如果有一个AI大模型做到了以下的任何一条,都是超级了不起的突破——1、强大。比肩O1的推理能力,暂时没有之一2、便宜。参数少,训练开销与使用费用小了一个数量级3、开源。任何人均可自行下载与部署,提供论文详细说明训练步骤与窍门,甚至提供了可以运行在手机上的mini模型。4、免费。官方目前提供的服务完全免费,任何人随时随地可用5、联网。暂时唯一支持联网搜索的推理模型(o1还不支持)6、本土。深度求索是一家很小规模的年轻中国公司,由没有海外经历甚至没有资深从业经验的本土团队开发完成上面的六条,DeepSeek全部、同时做到了。实在太6了,6到不真实。如果这都不值得欢呼,还有什么值得欢呼?那么,现在看到这条微博的你应该去做什么呢?1、请直接访问:网页链接马上用起来,也有移动APP

【SD】向未来而生,关于SDXL你要知道事儿

可以看到细节又提升了不少,可惜的是,现在还不能配合tile来使用。在生成时间上,我的显卡是4080ti,速度在十秒左右。所以sdxl对于高配电脑还是可以接受的,但配置较低的朋友需要自己去测试一下了。当然,有人可能会说,这个操作好麻烦,生成一张图要去两个界面来回倒腾。在这里,我给大家再介绍一款插件。我们来到扩展列表中,搜索refine,点击安装插件,然后重启。启用这个插件,就可以让我们在文生图的界面直接使用refine模型,进一步到位的绘画。我填写一段正向提示词:a girl looks up at the sky in the city of cyberpunk,close-up,wearing a helmet,fantasy elements,game original,starry_sky,点击生成,生产过程中的显存使用情况,显存基本跑满。最终的生成图像用时36秒,效果我觉得非常好,很难想象这是曾经的sd能够直出的效果。然后,我用同样的提示词在midjourney里面进行了生成。从心里的实话来说,我觉得midjourney的美感把握和图像的细节绘制还是要更胜一筹的。但对于SD而言,它的优势并不在于美图直出,而是它强大的可操控性,只要继续在SDXL上去发展,它的未来是不可限量的。

通往 AGI 之路

《[AI「视觉图灵」时代来了!字节OmniHuman,一张图配上音频,就能直接生成视频](https://mp.weixin.qq.com/s/0OYlkcxoFvx6Z9IN-aq90w)》字节跳动推出的新技术OmniHuman,利用单张图片和音频生成生动的视频,突破了传统技术的局限。它通过多模态混合训练,解决了高质量数据稀缺的问题,实现了对任意尺寸图像的支持,生成自然的人物运动。《[甲子光年:2025 DeepSeek开启AI算法变革元年](https://waytoagi.feishu.cn/record/S5Jtrlw9neyXMccQ6CAcZsxHnXu)》DeepSeek的出现标志着算力效率拐点显现,其通过优化算法架构,显著提升了算力利用效率,打破了算力至上的传统认知。同时,AI基础大模型的参数量迎来拐点,2025年发布的大模型呈现低参数量特征,为本地化部署到AI终端运行提供了可能。此外,报告强调2025年是算法变革的元年,DeepSeek的推理模型开启了算法变革,其训练过程聚焦于强化学习,提升了模型的推理能力。《[R1之后,提示词技巧的变与不变](https://mp.weixin.qq.com/s/-51tjTWRdi19sEBCQMe1sw)》在R1时代,使用AI提示词的关键在于提供足够的背景信息,而非复杂的结构。简单大白话仍然有效,但信息量不足则难以得到理想结果。示例和框架可帮助理清思路,但最终影响在于你的思考和表达。利用乔哈里视窗分析信息需求,避免过度指令化,让AI自由思考,从而激发更高的创意和效果。“有用的不是技巧,而是你的思考!”

Others are asking
如何在DEEPSEEK里创建一个专门用于”爆款文案二创“的智能体?
在 DEEPSEEK 里创建一个专门用于“爆款文案二创”的智能体,您可以按照以下步骤进行操作: 1. 添加工作流:将已经发布的工作流添加到创建好的智能体。 2. 设定人设与回复逻辑:设定与“爆款文案二创”相关的人设和回复逻辑。 3. 测试:对设定好的智能体进行测试。 4. 发布智能体:选择右上角,填写发布信息,选择发布渠道,确认发布,等待审核完成,发布成功。发布成功之后,点击分享,复制访问链接给朋友。 需要注意的是,以上步骤仅供参考,具体操作可能因 DEEPSEEK 平台的更新而有所变化。
2025-02-06
linux 下部署deepseek
在 Linux 下部署 DeepSeek 的步骤如下: 1. 下载代码仓库。 2. 安装依赖(注意有两个依赖未放在 requirements.txt 里)。 3. 启动 webui 的 demo 程序,然后用浏览器登陆服务器的 ip:8080 就能试玩。此 demo 提供了 3 个参数: server_name:服务器的 ip 地址,默认 0.0.0.0。 servic_port:即将开启的端口号。 local_path:模型存储的本地路径。 4. 第一次启动后生成语音时,需查看控制台输出,它会下载一些模型文件,因此比较慢,且可能因网络问题失败。但第一次加载成功后,后续会顺利。 5. 基于此基础可进行拓展,比如集成到 agent 的工具中,或结合 chatgpt 做更拟人化的实时沟通。 webui 上可设置的几个参数说明: text:指需要转换成语音的文字内容。 Refine text:选择是否自动对输入的文本进行优化处理。 Audio Seed:语音种子,是一个数字参数,用于选择声音类型,默认值为 2,是很知性的女孩子的声音。 Text Seed:文本种子,是一个正整数参数,用于 refine 文本的停顿。实测文本的停顿设置会影响音色、音调。 额外提示词(可写在 input Text 里):用于添加笑声、停顿等效果。例如,可以设置为 。 使用 DeepSeek 的步骤: 1. 搜索 www.deepseek.com,点击“开始对话”。 2. 将装有提示词的代码发给 Deepseek。 3. 认真阅读开场白之后,正式开始对话。 DeepSeek 的设计思路: 1. 将 Agent 封装成 Prompt,将 Prompt 储存在文件,保证最低成本的人人可用的同时,减轻调试负担。 2. 通过提示词文件,让 DeepSeek 实现同时使用联网功能和深度思考功能。 3. 在模型默认能力的基础上优化输出质量,并通过思考减轻 AI 味,增加可读性。 4. 照猫画虎参考大模型的 temperature 设计了阈值系统,但是可能形式大于实质,之后根据反馈可能会修改。 5. 用 XML 来进行更为规范的设定,而不是用 Lisp(有难度)和 Markdown(运行不太稳定)。 关于 DeepSeek 的评论: 游戏科学创始人、黑神话悟空制作人冯骥称:年前还是认真推下 DeepSeek 吧。V3 已经用了一个月,但 R1 仅仅用了 5 天。DeepSeek 可能是个国运级别的科技成果。它具备强大的推理能力,比肩 O1;参数少,训练开销与使用费用小;开源,任何人均可自行下载与部署;免费,官方目前提供的服务完全免费;支持联网搜索,是暂时唯一支持联网搜索的推理模型;由没有海外经历甚至没有资深从业经验的本土团队开发完成。如果这都不值得欢呼,还有什么值得欢呼?看到这条微博的您应直接访问网页链接马上用起来,也有移动 APP。
2025-02-06
deepseek
DeepSeek 是一家成立于 2023 年,总部位于中国杭州,专注于人工智能基础技术研究的科技公司。其致力于探索 AGI(通用人工智能)的实现路径,定位为聚焦大模型研发与应用,提供高效、安全、可控的 AI 技术解决方案。 将 DeepSeek 比喻成“AI 界的拼多多”是偏颇的,认为其秘方是多快好省也不全面。早在 2024 年 5 月 DeepSeekV2 发布时,就以多头潜在注意力机制(MLA)架构的创新在硅谷引发小范围轰动,V2 的论文也在 AI 研究界引发广泛分享和讨论。当时在国内舆论场,DeepSeek 被描摹成“大模型价格战的发起者”。 如果 V3 是 DeepSeek 的 GPT3 时刻,接下来会如何发展无人知晓,但有趣的事还在后头。DeepSeek 应不会永远是“计算机系 Pro”的存在,它应为全人类的人工智能事业做更大贡献,且已成为中国最全球化的 AI 公司之一,赢得全球同行甚至对手尊重的秘方是硅谷味儿的。 使用地址:https://chat.deepseek.com/(有手机客户端) 模型下载地址:https://github.com/deepseekai/DeepSeekLLM?tab=readmeovfile API 文档地址:https://apidocs.deepseek.com/zhcn/ DeepSeek 的提示词使用方法比较长,单独列了一篇
2025-02-06
deepseek与大健康如何落地
DeepSeek 与大健康的落地可以从以下几个方面考虑: 1. 提示词应用: 可以通过搜索 www.deepseek.com 并点击“开始对话”来使用 DeepSeek。 将装有提示词的代码发给 DeepSeek,认真阅读开场白后正式开始对话。 提示词的设计思路包括将 Agent 封装成 Prompt 并存储在文件中,以实现同时使用联网和深度思考功能,优化输出质量等。 2. 联网版实现: 通过工作流 + DeepSeek R1 大模型,实现联网版的 R1 大模型。 拥有扣子专业版账号,开通 DeepSeek R1 大模型,包括访问特定地址、在火山方舟中进行开通管理等操作,添加在线推理模型。 创建智能体,点击创建完成智能体的创建。 3. 开源策略: DeepSeek 选择走全球开源社区路线,分享模型、研究方法和成果,吸引反馈并迭代优化。开源包括模型权重、数据集、预训练方法和高质量论文等。 需要注意的是,目前提供的内容中未直接提及 DeepSeek 与大健康落地的具体关联,您可以根据以上 DeepSeek 的相关特点和技术,结合大健康领域的需求和场景,进一步探索落地的可能性。
2025-02-06
low cost of Deepseek AI
关于 DeepSeek AI 的低成本相关信息如下: 在设计思路方面,将 Agent 封装成 Prompt 并储存在文件,以保证最低成本的人人可用,同时减轻调试负担。通过提示词文件,让 DeepSeek 实现同时使用联网功能和深度思考功能,在模型默认能力基础上优化输出质量,增加可读性,并设计了阈值系统,用 XML 进行规范设定。 存在对 DeepSeek 的“低成本”AI 的批评声音,如被讽刺为空洞的营销噱头,无法与国际大作相比,甚至被用洋垃圾作比喻,被指“崇洋媚外”。
2025-02-06
deepseek适合做ai知识库检索工具吗
DeepSeek 是基于 AI 模型的产品,只是品牌名,需要搭配具体模型,如 DeepSeek V3(类 GPT4o)和 DeepSeek R1(类 OpenAI o1)。 文本嵌入可用于实现高效的知识检索,相似或相关的字符串在嵌入空间中靠得更近,利用快速向量搜索算法,一个文本语料库可以被分割成块,给定的查询被嵌入后,能进行向量搜索找到最相关的嵌入文本块。 知识库就像 AI 的“活字典”,可以随时更新,例如包含最新新闻、科技发展、法律法规等内容,AI 遇到不确定问题时可从中检索相关信息给出更准确回答,像很火的 AI 搜索就是将整个互联网实时数据作为知识库。 但仅根据上述信息,不能明确判断 DeepSeek 是否适合做 AI 知识库检索工具,还需要综合考虑其具体性能、与您需求的匹配度等多方面因素。
2025-02-06
deepseek R1部署
以下是关于 DeepSeek R1 部署的相关信息: DeepSeek R1 大模型成为国民刚需,但官网卡顿且存在不能联网等问题。 实现联网版 R1 大模型的核心路径是通过工作流+DeepSeek R1 大模型。 部署步骤包括: 拥有扣子专业版账号,若为普通账号需自行升级或注册专业号。 开通 DeepSeek R1 大模型,访问地址:https://console.volcengine.com/cozepro/overview?scenario=coze ,在火山方舟中找到开通管理,开通服务并添加在线推理模型,添加后在扣子开发平台才能使用。 创建智能体,点击创建完成智能体的创建。
2025-02-06
怎么本地部署DEEPSEEK
以下是本地部署 DeepSeek 的步骤: 1. 拥有扣子专业版账号:如果您还是普通账号,请自行升级或注册专业号后使用。开通成功后会呈现相应状态。 2. 开通 DeepSeek R1 大模型: 访问地址:https://console.volcengine.com/cozepro/overview?scenario=coze 打开火山方舟,找到开通管理,找到 DeepSeek R1 模型,点击开通服务。 添加在线推理模型,添加后在扣子开发平台才能使用。添加过程包括添加模型和完成接入。 3. 创建智能体:点击创建,先完成一个智能体的创建。 4. 创建工作流: 创建一个对话流,命名为 r1_with_net,注意是“创建对话流”。 开始节点,直接使用默认的。 大模型分析关键词设置:模型选择豆包通用模型lite,输入直接使用开始节点的 USER_INPUT 作为大模型的输入,系统提示词为“你是关键词提炼专家”,用户提示词为“根据用户输入`{{input}}`提炼出用户问题的关键词用于相关内容的搜索”。 bingWebSearch搜索:插件选择 BingWebSearch,参数使用上一个节点大模型分析输出的关键词作为 query 的参数,结果中 data 下的 webPages 是网页搜索结果,将在下一个节点使用。 大模型R1 参考搜索结果回答:这里需要在输入区域开启“对话历史”,模型选择韦恩 AI 专用 DeepSeek,输入包括搜索结果和选择开始节点的 USER_INPUT,开启对话历史,设置 10 轮,默认不开启对话历史,开启后默认是 3 轮,系统提示词不需要输入。 结束节点设置:输出变量选择大模型R1 参考搜索结果回答的输出,回答内容里直接输出:{{output}}。 5. 测试并发布工作流:输入您的测试问题,测试完成后,直接发布工作流。
2025-02-06
在哪个网站可以部署deepseek更简单,无需代码,
以下是一些可以部署 DeepSeek 且相对简单、无需代码的网站: 1. 网址:https://www.deepseek.com/zh 。DeepSeek 很方便,国内能访问,网页登录很便捷,目前完全免费。点击开始对话,左边选择代码助手即可。 2. 网址:https://www.cursor.com/ 。使用 Cursor 可以不用下载上一步中的 Pycharm,通过对话获得代码即可。因为这里面用的是大语言模型 Claude3.5sonnet、GPT4o 等语言模型。
2025-02-06
deepseek的本地化部署对于软硬件的具体要求
DeepSeek 的本地化部署对于软硬件的具体要求如下: 系统:Windows 7 以上(不建议使用 XP 系统)。 显卡要求:NVDIA 独立显卡且显存至少 4G 起步。 硬盘:留有足够的空间,最低 100G 起步(包括模型)。 内存和显存配置: 生成文字大模型: 最低配置:8G RAM + 4G VRAM 建议配置:16G RAM + 8G VRAM 理想配置:32G RAM + 24G VRAM(如果要跑 GPT3.5 差不多性能的大模型) 生成图片大模型(比如跑 SD): 最低配置:16G RAM + 4G VRAM 建议配置:32G RAM + 12G VRAM 生成音频大模型: 最低配置:8G VRAM 建议配置:24G VRAM 需要注意的是,mac 系统、AMD 显卡、低显卡的情况也可以安装使用,但功能不全,出错率偏高,严重影响使用体验,个人建议升级设备或者采用云服务器玩耍。最低配置可能运行非常慢。
2025-02-06
ai本地部署对比网页版区别在哪
AI 本地部署和网页版主要有以下区别: 1. 出图速度:网页版出图速度快,本地部署可能相对较慢。 2. 硬件配置要求:网页版不吃本地显卡配置,本地部署对电脑配置要求较高,配置不高可能出现生成半天后爆显存导致出图失败的情况。 3. 出图质量:本地部署出图质量通常高于网页版。 4. 功能扩展性:本地部署可以自己添加插件,网页版功能相对固定。 5. 算力限制:网页版为节约算力成本,通常只支持出最高 1024×1024 左右的图,制作横板、高清等图片受限;本地部署算力限制较小。 6. 电脑使用状态:本地部署使用期间电脑基本处于宕机状态,网页版则无此问题。 例如,在图像生成方面,线上的优势在于找参考、测试模型,线下则是主要的出图工具。一些在线体验平台如哩布哩布 AI 每天有一百次生成次数,集成了最新模型;Clipdrop 每天免费 400 张图片,需排队,出图约需二三十秒。
2025-02-05