相关文章
857 篇高质量内容本地Ollama部署DeepSeek R1模型接入Word
提升工作效率,本地部署DeepSeek-R1模型,享受快速响应和数据安全。 核心内容: 1. 本地部署DeepSeek-R1模型的优势分析 2. 详细步骤指导如何在本地部署DeepSeek-R1模型 3. 将DeepSeek-R1模型集成到Word的操作步骤
白话科普 | 看完即可上手DeepSeek训练,构建专属大模型,LoRA技术让你轻松训练行业大模型
掌握LoRA技术,轻松微调AI大模型,让深度学习更贴近实际应用。 核心内容: 1. 微调技术的核心原理与重要性 2. LoRA技术在微调中的应用与优势 3. 从数据准备到模型评估的全流程实操指南
o3-mini来了,OpenAI首个可以免费用的推理模型!还是被DeepSeek卷到了!
OpenAI的o3-mini系列模型免费开放,AI推理能力迎来新突破! 核心内容: 1. o3-mini系列模型的发布背景及特点 2. o3-mini在STEM任务中的卓越表现 3. 实战体验与“降智”问题的探讨
DeepSeek-R1大模型本地化部署
DeepSeek-R1大模型性能超越OpenAI o1,Ollama工具助您轻松实现本地化部署。 核心内容: 1. DeepSeek-R1大模型性能优势及与OpenAI o1对比 2. Ollama开源项目简化大模型本地化部署流程 3. 使用Ollama部署DeepSeek-R1的优势及详细步骤
谢谢Deepseek,o3-mini发布即免费!编程断崖式领先,思考过程冰冷而客观
OpenAI o3-mini的发布标志着编程领域的一场革命,免费开放给所有用户,性能大幅提升,价格断崖式下降。 核心内容: 1. o3-mini正式上线ChatGPT,免费用户也可使用 2. 不同用户类别的对话限制和API访问权限 3. o3-mini在速度、准确性、价格上的显著优势,特别是编程能力的巨大进步
奥特曼率队深夜血战DeepSeek,o3-mini急上线!价格骨折免费用,ChatGPT被挤爆
OpenAI急推o3-mini,价格战打响,ChatGPT体验升级。 核心内容: 1. OpenAI发布o3-mini和o3-mini-high两大版本,ChatGPT功能升级 2. o3-mini价格大幅下调,比o1-mini便宜63%,免费用户也能体验 3. ChatGPT各版本访问限制和定价策略,API向高级别开发者开放
o3-mini 完全指南:一个被 DeepSeek 破大防的模型
o3-mini模型的颠覆性表现,一探究竟! 核心内容: 1. o3-mini模型的逆天口德与评价能力 2. 对DeepSeek和Anthropic的犀利评价 3. o3-mini与o1-mini的功能对比
Cursor现已原生支持 DeepSeek R1!
AI代码编辑器Cursor的新突破,支持DeepSeek R1模型,为开发者带来更丰富的AI编程选择。 核心内容: 1. Cursor宣布支持DeepSeek系列AI模型,部署自家服务器 2. 与Claude Sonnet对比,实际开发中后者表现更优 3. AI代码编辑器市场竞争激烈,Cursor引入DeepSeek拓展选择
大模型知识蒸馏指南
模型蒸馏技术深度解析,助力资源受限设备性能提升。 核心内容: 1. 模型蒸馏技术概述及其在深度学习中的应用价值 2. 知识蒸馏的核心组件:知识、蒸馏算法、师生架构 3. 知识蒸馏流程详解,包括soft targets的作用与影响
HybridFlow:基于 Ray 构建灵活且高效的 RLHF 编程框架
探索基于Ray的RLHF编程框架HybridFlow,字节跳动资深工程师亲授高效解决方案。 核心内容: 1. RLHF概念与训练流程解析 2. RLHF面临的挑战与动机 3. HybridFlow框架设计与实现细节
ollama 部署 deepseek-r1 70B 模型完整指南
掌握深度学习模型部署的详细步骤,从下载到运行,一文全掌握。 核心内容: 1. 获取GGUF格式模型文件,通过ModelScope平台下载并量化 2. 配置Ollama推理框架,安装与环境设置 3. 远程访问配置,修改服务配置以实现跨设备访问
AI根据接口文档生成服务端模拟工程
利用AI自动生成模拟服务端代码,提高研发效率,降低测试误差。 核心内容: 1. 利用AI工具豆包和Google AI studio Gemini 2.0生成模拟服务端代码 2. 通过AI生成的模拟服务端代码加速研发流程,提高测试效率 3. AI工具促进技术创新,优化资源分配,降低人为错误风险
聊聊DeepSeek R1的知识蒸馏与应用思考
探索AI推理模型的创新突破和实际应用。 核心内容: 1. DeepSeek-R1模型的冷启动数据引入和两阶段强化学习 2. DeepSeek-R1在推理任务中的高性能表现和模型蒸馏能力 3. DeepSeek-R1-Zero基于强化学习的创新训练方式和应用场景
谈谈对DeepSeek-R1的一些理解
深入浅出解读DeepSeek-R1技术框架,揭示其在自动化数据生成和强化学习中的应用潜力。 核心内容: 1. Inference/test-time scaling RL的基本概念及其在DeepSeek-R1中的重要作用 2. 如何将Inference/test-time scaling与RL流程结合,提高模型性能 3. 作者对DeepSeek-R1技术实现的猜想与分析,以及对现有认知的挑战
手把手教你AnythingLLM+Ollama+qwen 部署本地大模型
周末在笔记本部署本地大模型,过程详细分享,快来! 核心内容: 1. 部署本地大模型的步骤 2. 相关命令扩展介绍 3. 不同模型的参数与大小
领域大模型修炼手册—从训练、评测到应用搭建
这是一份关于领域大模型的实用手册,探索其训练与应用的创新方案。 核心内容: 1. 领域大模型的应用背景与需求 2. LLM的构建流程与核心部分 3. 开源的训练方案及部署方案
Opal 机器学习平台:爱奇艺数智一体化实践
这是关于爱奇艺 Opal 机器学习平台的实践分享,助您了解数智一体化新成果。 核心内容: 1. 机器学习平台 Opal 的研发背景 2. 非一体化旧方案存在的问题 3. Opal 平台的功能及业务覆盖场景
爱奇艺 Opal 机器学习平台:特征中心建设实践
这是关于爱奇艺 Opal 机器学习平台特征中心建设的深度好文。 核心内容: 1. Opal 机器学习平台的概述 2. 特征中心的定义与适用场景 3. 特征中心解决的问题及优化方向
构建 Ollama Cloud - 将本地推理扩展到云端
这是关于将本地推理扩展到云端的指南,为 AI 开发提供新思路。 核心内容: 1. Ollama 的本地开发设置及优势 2. 从本地到云端的过渡方式与挑战 3. 服务器在扩展中的作用及优势
DeepSeekV3如何一次性预测多个token
推荐语: 这篇文章深入解读 DeepSeekV3 的 MTP 方法,极具技术价值! 核心内容: 1. 阐述做 MTP 的原因 2. 介绍 MTP 方法的探索 3. 详解 DeepSeek MTP 及总结