JOTO
Contact us
← AI 智库
模型与技术专题

模型训练

整理模型训练相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

857 篇高质量内容
模型训练
模型训练
模型训练

Cursor 新版本要来了!同一个窗口使用Agent+Chat!上下文增强、UI升级、界面更清爽。

Cursor新版本带来界面升级和上下文增强,让你的工作效率和体验更上一层楼。 核心内容: 1. 新的Chat/Composer组合界面,共享上下文,操作更便捷 2. Deepseek R1思维UI、MCP服务器配置等新功能,提升工作效率 3. 界面更清爽,设置布局优化,新增上下文选择器等细节改进

模型训练
模型训练
模型训练

Cursor + MCP:效率狂飙!一键克隆网站、自动调试错误,社区:每个人都在谈论MCP!

提升网站开发效率的利器,MCP让AI与现实世界数据无缝对接。 核心内容: 1. MCP的重要性和实用性,引领开发工具新时代 2. 一键克隆网站和自动调试错误的实战演示 3. MCP配置和常见问题的解决方案

模型训练
模型训练
模型训练

DeepSeek-进阶版部署(Linux+GPU)

深入Linux+GPU环境下的DeepSeek部署实战。 核心内容: 1. 确认Linux机器的GPU配置和型号 2. 根据显卡型号下载并安装NVIDIA驱动 3. 升级内核以确保驱动安装成功

模型训练
模型训练
模型训练

QwQ-32B一键部署!真正的0代码,0脚本,0门槛

阿里云QwQ-32B模型0代码一键部署,让AI模型部署变得触手可及。 核心内容: 1. QwQ-32B模型性能介绍及其与DeepSeek-R1的对比 2. 阿里云一键部署方案OpenWebUI+Ollama的详细步骤 3. 本地部署QwQ-32B的ECS配置要求及操作系统版本建议

模型训练
模型训练
模型训练

一篇文章讲清楚,到底如何训练自己的专属大模型

一篇文章带你深入了解如何定制专属大模型,提升工作效率和创造力。 核心内容: 1. 通过对话调教,让大模型记住并适应你的个性化需求 2. 利用外挂知识库技术,扩展大模型的知识边界,快速获取所需信息 3. 开源模型微调,用专属数据训练,让大模型从"通才"变"专才"

模型训练
模型训练
模型训练

这可能是全网最保姆的DeepSeek微调教学

掌握深度学习模型微调的全方位指南,全面提升模型性能。 核心内容: 1. 微调在提升大模型能力中的作用与重要性 2. DeepSeek模型微调的具体步骤与应用场景 3. 公开课提供的教学资源与实操指导

模型训练
模型训练
模型训练

在树莓派5上运行9款流行的AI模型:哪些能用?哪些不行?

探索树莓派5上AI模型运行能力,从基础到强大,一文带你了解。 核心内容: 1. Raspberry Pi 5配置概览及其作为小型电脑的优势 2. 9款AI语言模型在树莓派上的运行测试与性能比较 3. 实验方法、任务设定及性能评价指标详解

模型训练
模型训练
模型训练

LLM模型层+应用层 Full-Stack RL的一种设想

探索全栈强化学习在大型语言模型中的应用前景。 核心内容: 1. 应用层中将工作流纳入RL过程的设想 2. LLM模型context长度限制与优化策略 3. 注意力结构设计和RL优化的可能性与挑战

模型训练
模型训练
模型训练

DeepSeek到底用了多少GPU?

AI大模型DeepSeek以其超低价格和高效性能引发全球关注,其背后的GPU资源投入成为热议话题。 核心内容: 1. DeepSeek的低价策略及其对AI算力观念的冲击 2. DeepSeek与幻方量化的渊源及GPU资源配置 3. DeepSeek的GPU投资规模及资源分布情况

模型训练
模型训练
模型训练

速抢!体验TencentOS Server AI 全栈DeepSeek工具箱,获得80%提速

企业私有化部署的新选择,提升DeepSeek推理效率80%以上。 核心内容: 1. TencentOS Server AI全栈式AI环境介绍 2. 私有化部署TencentOS Server AI版Linux操作系统 3. 性能实测:相比开源方案提升80%以上

模型训练
模型训练
模型训练

triton+vllm后端部署LLM服务

深入探索vLLM后端部署LLM服务的详细步骤和性能测试。 核心内容: 1. 如何拉取vLLM后端镜像并启动容器 2. 准备模型目录和配置文件 3. 性能测试的参考文档和步骤

模型训练
模型训练
模型训练

Ollama和vLLM我们到底应该用哪个?

深入剖析大语言模型(LLM)推理框架,助你选择合适的工具。 核心内容: 1. 大语言模型(LLM)推理框架Ollama与vLLM的优劣对比 2. 从资源利用、部署维护、特定用例等多个维度进行分析 3. 基于实际测试结果,探讨不同场景下的最佳选择

模型训练
模型训练
模型训练

不建议在本地部署DeepSeek-R1:32B以下小模型,文末推荐适用主机

DeepSeek小模型本地部署性能受限,32B大模型才是明智之选。 核心内容: 1. 实测DeepSeek小模型在本地部署的性能表现 2. 32B模型相比小模型在复杂任务中的显著优势 3. 推荐10000元预算下适合部署DeepSeek-32B的主机配置

模型训练
模型训练
模型训练

终于有人说清楚AI开发的全流程了!

终于有人说清楚AI开发的全流程了! 核心内容: 1. AI需求开发流程的全面解析,从需求分析到产品发布 2. 提示词工程在AI开发中的应用及其对跨团队协作的影响 3. 实时监控与用户反馈在持续优化AI模型中的关键作用

模型训练
模型训练
模型训练

模型部署:Ollama 和 GPUStack如何选择?

面对复杂多样的模型部署需求,如何选择合适的工具?本文深入对比分析Ollama和GPUStack,为你提供决策参考。 核心内容: 1. Ollama轻量级本地部署工具的特点与适用场景 2. GPUStack企业级GPU/NPU资源管理平台的优势与局限 3. 根据具体需求,如何选择Ollama或GPUStack进行模型部署

模型训练
模型训练
模型训练

6 个 Cursor 0.46 版本高频问题

Cursor 0.46 版本更新深度解析,为你解答最关心的六大问题。 核心内容: 1. 0.46 版本更新的必要性与兼容性问题 2. Claude 3.7 版本的使用条件与替代方案 3. Claude 3.7 实际表现与优化建议 4. MCP 安装失败的原因与解决方案 5. Composer 功能变更的背后逻辑 6. 0.46 版本 UI 变化对使用的影响

模型训练
模型训练
模型训练

我打算用腾讯IMA,实现长生不老。

探索AI实现数字永生,腾讯IMA助力个人分身训练。 核心内容: 1. 利用AI实现数字永生的概念和愿景 2. 腾讯IMA工具在训练个人AI分身中的应用 3. 数字永生计划的三个阶段:筑基、元婴和智能体发展

模型训练
模型训练
模型训练

私有化部署DeepSeek + RAGFlow,技术小白也能轻松学会

无需专业知识,轻松部署DeepSeek R1 + RAGFlow,体验AI大模型的神奇魅力。 核心内容: 1. 本地环境搭建与Docker安装 2. ollama配置与DeepSeek模型下载 3. 运行模型并测试对话功能

模型训练
模型训练
模型训练

一步一步构建 MCP Server

深入探索 TypeScript 构建 MCP 服务器的全过程。 核心内容: 1. 创建 MCP 服务器的步骤详解 2. 使用 OpenWeatherMap API 获取天气数据 3. TypeScript 开发环境的搭建与服务器脚手架生成

模型训练
模型训练
模型训练

三水区市场监管局开展DeepSeek应用技能培训

深化市场监管数字化转型,掌握人工智能技术应用新技能。 核心内容: 1. 三水区市场监督管理局举办DeepSeek技能培训 2. 培训内容涵盖DeepSeek操作及人工智能政务应用 3. 培训效果显著,将促进市场监管智慧化应用场景创新