JOTO
联系我们
← AI 智库
模型与技术专题

模型训练

整理模型训练相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

857 篇高质量内容
模型训练
模型训练
模型训练

深度剖析 MCP SDK 最新版: Streamable HTTP 模式正式发布,为你实测揭秘

揭开MCP SDK最新版streamable HTTP模式的神秘面纱,深入解析与实操指南。 核心内容: 1. MCP SDK v1.9.0版本更新亮点:streamable HTTP模式 2. 快速开启streamable HTTP模式的步骤与核心参数解析 3. 客户端和服务端代码示例,以及session-id的理解和应用

模型训练
模型训练
模型训练

Embedding模型微调:基于已有数据快速构建训练与评估数据集

掌握Embedding模型微调,提升NLP任务性能。 核心内容: 1. Embedding模型微调的核心概念与数据依赖 2. 构建高质量微调训练集与评估集的实用步骤 3. 正负样本构建、数据增强等关键技术的应用

模型训练
模型训练
模型训练

RAG与微调,大语言模型的“大脑升级”,该选哪条路?(小白科普)

理解大语言模型的“大脑升级”技术,选择适合的场景应用。 核心内容: 1. RAG和微调的定义及其工作原理 2. RAG和微调在知识处理和资源需求上的差异 3. 不同场景下RAG和微调的适用性分析

模型训练
模型训练
模型训练

两万字记录微软Build2025主题演讲谈了什么:萨提亚展现好人缘,奥特曼、马斯克、黄仁勋轮番出镜,软件工程的本质在于好工具

微软Build 2025大会精华汇总,AI代理成为焦点,展现微软生态新格局。 核心内容: 1. 微软Build 2025大会聚焦"开放代理网络",萨提亚将AI发展比作平台转变"中局" 2. 微软高管团队现场演示,萨提亚邀请奥特曼、马斯克、黄仁勋等业界领袖分享AI见解 3. 微软宣布集成Anthropic主导的MCP Agent协议,展现全栈技术进展,从开发者工具到AI平台

模型训练
模型训练
模型训练

百度自研Agent专用版模型上线千帆!已针对企业级大模型应用进行指令调优

百度千帆平台新升级,企业级大模型应用更高效! 核心内容: 1. 百度自研Qianfan-Agent-Intent-32K模型上线,提升企业级任务性能 2. 第三方大模型功能优化,支持更长文本和模型部署 3. SFT模型训练新增图像理解样板间,实现多模态大模型微调

模型训练
模型训练
模型训练

一文读懂微调技术Lora和SFT的异同

深入了解AI微调技术的新视角,探索Lora和SFT的精髓。 核心内容: 1. SFT:如何通过监督式微调提升模型领域专业性 2. Lora:低秩自适应优化模型的技术原理与优势 3. Lora和SFT在数据依赖和计算资源上的对比分析

模型训练
模型训练
模型训练

基于 Function Calling 构建代码执行工具时遇到的问题

探索AI模型如何执行复杂代码,实现智能化任务。 核心内容: 1. AI模型的高级能力:理解意图并执行复杂指令 2. 实现Function Calling机制,让模型调用工具和运行代码 3. 后端系统如何解析并执行模型请求的Python代码

模型训练
模型训练
模型训练

向量检索能力SOTA,字节Seed1.5-Embedding模型训练细节公开

字节跳动Seed团队最新向量模型Seed1.5-Embedding技术细节公开,达到中英文SOTA效果,即将开放API接口。 核心内容: 1. Seed1.5-Embedding模型优化迭代的三大方向 2. 在MTEB和BRIGHT两大评测榜单中英双赛道SOTA表现 3. 模型API接口即将在火山方舟平台开放,敬请期待

模型训练
模型训练
模型训练

我也曾一上来就想微调大模型,直到我发现自己错得离谱!

深入浅出解析大型语言模型提升准确性的两大法宝:RAG与微调。 核心内容: 1. RAG:给AI装上实时搜索引擎,快速获取最新答案 2. 微调:让AI直接"背"下知识,脱口而出专业答案 3. RAG与微调的适用场景、优缺点对比分析

模型训练
模型训练
模型训练

OpenAI发布GPT-4.1系列模型,对行业最大吸引力是什么?

OpenAI GPT-4.1系列模型,引领AI进入新纪元。 核心内容: 1. GPT-4.1系列模型的战略调整与核心特点 2. 性能提升:编码与指令遵循能力增强 3. 性价比优化:分层定价与成本降低

模型训练
模型训练
模型训练

如何在 ONLYOFFICE 中离线使用 Ollama AI 模型

利用ONLYOFFICE与Ollama AI模型的集成,实现离线高效的文本编辑与AI支持。 核心内容: 1. 通过集成Ollama AI模型引入ONLYOFFICE编辑器的先进AI功能 2. 本地部署AI模型以保护数据隐私和满足合规要求 3. 安装Ollama并启动本地AI服务器,实现ONLYOFFICE的AI插件设置

模型训练
模型训练
模型训练

应用流程文档(流程图+时序图):与Cursor AI协作的最佳语言

掌握流程文档,提升Cursor AI编程效率。 核心内容: 1. 应用流程文档在Cursor开发中的重要性 2. 缺乏流程文档时的开发困境与案例分析 3. 流程图、时序图和UML图在流程文档中的应用技巧

模型训练
模型训练
模型训练

“烧掉94亿个OpenAI Token后,这些经验帮我们省了43%的成本!”

**深度解析OpenAI Token成本控制,助力开发者节省开支。** 核心内容: 1. 选择合适的模型以减少成本 2. 利用提示词缓存降低重复调用成本 3. 优化输出Token数量和使用Batch API处理非实时任务

模型训练
模型训练
模型训练

玩转大模型,你的GPU显存够用吗?一文看懂估算方法

掌握GPU显存估算技巧,高效部署大型模型。 核心内容: 1. GPU显存与模型部署的关系解析 2. 估算显存需求的关键因素 3. 推理与训练场景下的显存估算方法

模型训练
模型训练
模型训练

AI重塑应用开发流程:谷歌Firebase Studio加速应用构建、测试和部署

掌握AI时代应用开发的新利器,Firebase Studio让全栈AI应用构建更高效。 核心内容: 1. Firebase Studio云端平台的创新特性与优势 2. 多模态输入与AI驱动迭代在应用开发中的应用 3. 跨设备预览与实时协作的便捷功能

模型训练
模型训练
模型训练

20 分钟,基于老站点生成 Vue 的多语言官网——DemoWay MCP Server 用户实战案例

快速升级老官网至现代Vue多语言版,AI辅助开发案例分享。 核心内容: 1. 将十年老官网转化为Vue、移动版、多语言官网的实战经验 2. 利用DemoWay MCP Server和AI技术,实现Code to Code的高效开发 3. AI在前端组件化开发中的局限性与应对策略

模型训练
模型训练
模型训练

你的想法+AI=完整程序!DeepSeek 让编程零门槛

AI编程新突破,DeepSeek V3让创意无需代码基础即可实现。 核心内容: 1. DeepSeek V3模型在编程能力上的显著提升 2. 通过五个小程序展示DeepSeek的实用性和易用性 3. AI技术如何降低编程门槛,拓展创意空间

模型训练
模型训练
模型训练

本地部署大语言模型

本地部署大语言模型的详细指南,ollama框架轻松实现。 核心内容: 1. 本地部署大语言模型的多种方式 2. ollama的下载与安装步骤 3. ollama命令列表及接口调用示例

模型训练
模型训练
模型训练

AI编程如何挑选合适的大模型?4个阶段+6个建议

AI编程时如何挑选合适的大模型?本文提供4个阶段的详细指导和6个实用建议。 核心内容: 1. AI模型选择的常见困惑和问题 2. 根据开发阶段和任务需求挑选AI模型的策略 3. 各阶段适用的AI模型推荐及成本考量

模型训练
模型训练
模型训练

从workflow到ReAct提升AI Agent智能化水平

探索AI Agent智能体的进化之路,从workflow模式到ReAct框架的突破。 核心内容: 1. AI Agent与传统workflow模式Agent的区别 2. 运维案例中LLM在workflow模式中的应用 3. ReAct框架对Agent智能化水平的提升作用