登录社区云,与社区用户共同成长
邀请您加入社区
通过在蓝耘平台上结合 DeepSeek 进行 AI 模型优化、分布式训练以及行业解决方案的应用实践,取得了一系列显著的成果和价值。在 AI 模型优化方面,通过量化、剪枝和参数调整等策略,成功提升了 DeepSeek 模型的性能。量化技术在不显著降低模型精度的前提下,有效减少了模型的内存占用和计算量,使得模型能够在资源受限的设备上高效运行。剪枝策略去除了模型中不重要的连接和神经元,降低了模型的复杂度
关于 OpenAI SDK 的通用知识,以 DeepSeek 聊天/推理模型为例进行演示:- 认识 API 的返回字段- 打印模型回复和每次对话的用量信息
DeepSeek-R1 于2025年1月20日正式发布,并同步开源模型权重。DeepSeek-R1 遵循 MIT License,允许用户通过蒸馏技术借助 R1 训练其他模型。DeepSeek-R1 上线 API,对用户开放思维链输出,通过设置 model=‘deepseek-reasoner’ 即可调用。性能方面,DeepSeek-R1 在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的
2025 年 1 月 20 日,DeepSeek 发布新一代推理模型 DeepSeek-R1,这是 DeepSeek 发展历程中的又一个重要里程碑。DeepSeek-R1 在数学、代码、自然语言推理等任务上,性能比肩 OpenAI o1 正式版,同时通过知识蒸馏等技术,显著提升了推理性能。该模型的发布,使得 DeepSeek 在人工智能领域的竞争力进一步增强,也为用户提供了更强大、更智能的服务。它
细化任务描述尽可能具体地阐述需求,避免模糊表述。比如,若想了解医学领域的知识,不要问 “什么是疾病”,而是具体到 “请详细解释阿尔茨海默病的发病机制、症状表现以及当前的治疗手段”。明确专业背景在 prompt 中点明涉及的专业领域和特定背景。例如,在金融领域,“从宏观经济学和投资学的角度,分析当前利率上升对房地产市场和股票市场的影响”。
多数企业的大模型初步应用场景为:知识库、智能客服等。该部分场景主要使用和技术。两者在使用中,又经常。笔者现将学习相关技术过程遇到的信息整理成文。相应的使用流程如下:底模选择 => Lora微调 => Rag增加 => 业务使用接下来,将通过Windows环境,实验整个流程。说明:该文章依据上述两个github开源工程实践,有能力者可直接按照github的教程操作。
通过插件或VBA接入DeepSeek,用户可将Excel从传统工具升级为智能数据处理平台。无论是基础的数据清洗,还是复杂的跨表分析与可视化,均可通过自然语言指令快速实现。建议定期更新插件并探索本地部署,以充分利用AI的潜力。
最近因为访问人数过多,大家在访问Deepseek官网或是使用手机APP版本的时候,经常会遇到服务器繁忙,请稍后再试的情况。于是就出现了很多本地部署DeepSeek大模型的文章或者视频教程,但是跑跑轻量级的还好,如果想体验满血版DeepSeek R1 671B这种几百个G的大模型,那在本地部署所需的硬件配置与费用也会更高。
无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,这套报告合集都将为您提供宝贵的信息和启示。: 大数据时代,越来越多的企业和机构需要处理海量数据,利用大模型技术可以更好地处理这些数据,提高数据分析和决策的准确性。: 大模型应用开发需要掌握机器学习算法、深度学习框架等技术,这些技术的掌握可以提高程序员的编码能力和分析能力,让程序员更加熟练地编写高质量的代码。想正式转到一些新兴的 AI 行业,
不少读者看了使用 DeepSeek-R1 模型生成的散文《[电鸡与土狗]》,在后台询问我如何在本地把这个模型跑起来,这就写一下,过程只需要 5 分钟。浏览器打开这个网站 👇看介绍,使用 ollama 可以在 macOS、Linux、Windows 上运行 LLama3.3、Phi-4 等开源大语言模型,当然,它也支持 DeepSeek-R1 模型!👨🏻💻下载安装 ollama,并在终端中
在跨境外贸竞争日益激烈的今天,AI工具正成为卖家降本增效、突破增长瓶颈的利器。无论是选品、营销、客服,还是日常运营,AI都在以前所未有的方式赋能外贸行业。今天,我们结合图片中的60+ AI工具,并特别介绍Deepseek AI,为大家梳理最具价值的AI应用,助力跨境外贸人精准运营,抢占市场先机!1. 视频营销:打造吸引力爆棚的产品视频代表工具: 11 Labs、Simplified、Veed、De
前两天发了一篇[怎么更好使用 DeepSeek 的文章]后,很多朋友在后台留言,希望了解 DeepSeek 的更多玩法。春节前几天事情较多,这两天终于闲下来了,打算再分享一些自己使用 AI 功能的经验,包括但不限于 DeepSeek。这一篇先介绍呼声较高的在本地部署 DeepSeek-R1 大语言模型的方案,后续会带来 DeepSeek 平替、DeepSeek 生成图片、视频、构建知识库等一系列文
北大亲自下场指导,北京大学·DeepSeek手册ⅠⅡ两册完整版!
DeepSeek-R1火的飞起,在中日美三个Appstore榜上登顶。还直接干崩英伟达,盘前先死13个点,连带着台积电一起。几乎一夜之间,所有人都在关注DeepSeek。DeepSeek,是一家在2023年7月17日成立的公司所开发的大模型名称。2024年1月5日,他们正式发布DeepSeek LLM,这是深度求索第一个发布的AI大模型。
DeepSeek 的量化版、蒸馏版和满血版在参数规模、性能表现和适用场景上各有千秋。满血版凭借庞大参数和强大性能,成为高端科研和大型企业复杂任务的首选;蒸馏版以其灵活的参数规模和在资源受限环境中的出色表现,满足了小型企业和实时响应场景的需求;量化版则通过量化技术实现了模型大小和推理速度的优化,在移动端和边缘设备上展现出独特优势。在实际应用中,用户应根据自身的需求、硬件资源和预算等因素,综合考虑选择
部署 DeepThink R1 AI 模型,让你无需联网就能运行强大的 AI 推理任务。下载安装适合你系统的版本(Windows / Mac / Linux)DeepThink R1 需要手动下载并添加到 Ollama。然后输入任何问题,比如:> 9.9 和 9.11 哪个更大?Ollama 是一个轻量级的大语言模型管理工具,支持。虽然终端可以运行 DeepThink R1,但使用。这个命令会自动
DeepSeek是杭州深度求索公司发布的一系列在知识类任务上表现出色的人工智能模型!这个模型以其高质量的编码服务而著称简直就是我们开发者的福利,并且DeepSeek还能够处理和分析复杂的数据,执行图像识别、自然语言处理、语音识别和预测分析等任务, 通过模拟人类大脑的神经网络结构来学习数据和规律,并利用这些知识来执行各种任务!官网地址 https://www.deepseek.com如图当下号称为目
今天的是 zty 写DeepSeek的第1篇文章,这个系列我也不知道能更多久,大约是一周一更吧,然后跟C++的知识详解换着更。最近啊,浙江出现了一匹AI界的黑马——DeepSeek。这个名字可能对很多人来说还比较陌生,但它已经在全球范围内引发了巨大的关注,甚至让一些科技巨头感到了压力。简单来说这 DeepSeek足以改变世界格局先赞后看养成习惯众所周知,一篇文章需要一个头图先赞后看养成习惯。
DeepSeek-V3-0324的震撼,不仅在于技术指标的飞跃,更在于它证明了顶级AI可以同时做到开源、免费、高性能。当硅谷还在争论"闭源模型是否更安全"时,DeepSeek用代码向世界宣告:真正的技术革命,永远属于那些把星辰大海写进开源协议的人。现在,打开你的Mac,启动那个352GB的模型文件吧——AI编程的全民时代,已经来临。
Windows 11 + Ollama + DeepSeek R1 本地部署,简话,感性认识