JOTO
Contact us
← AI 智库
模型与技术专题

模型训练

整理模型训练相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

857 篇高质量内容
模型训练
模型训练
模型训练

【浙江大学大模型】TableGPT表格处理大模型

模型训练
模型训练
模型训练

【Qwen2 微调之旅】Lora 对 Qwen2-7B-Instruct 的微调实战手册

模型训练
模型训练
模型训练

前女友面试官:大模型内存占用机制是怎样的?

模型训练
模型训练
模型训练

大模型微调终极指南

模型训练
模型训练
模型训练

如何让大模型输出 10k+字长文?

模型训练
模型训练
模型训练

对于大语言模型 LLM,什么时候使用微调?什么时候使用 RAG?

模型训练
模型训练
模型训练

详解MLOps,从Jupyter开发到生产部署

模型训练
模型训练
模型训练

GLM-4-Flash宣布免费,Agentic RAG体验,让我觉着,真香!

模型训练
模型训练
模型训练

GLM-4-Flash免费:在线微调GLM-4-Flash + Function Calling搭建法律知识库

模型训练
模型训练
模型训练

一文读懂 LLM 如何进行微调?

模型训练
模型训练
模型训练

为什么你需要了解小型语言模型

模型训练
模型训练
模型训练

预训练(Pre-training),人工智能(AI)领域的预训练是什么,初步认识预训练

模型训练
模型训练
模型训练

什么是大模型微调及各种微调技术介绍

模型训练
模型训练
模型训练

10G显存,使用Unsloth微调Qwen2并使用Ollama推理

模型训练
模型训练
模型训练

OpenAI:GPT-4o也能微调了!让你的模型更懂你!

模型训练
模型训练
模型训练

Qwen2为什么不再叫Chat对话模型,而是Instruct指令微调模型,两者有什么区别

模型训练
模型训练
模型训练

基于DSPy和微调,提升Chat模型解决国际象棋难题的能力

模型训练
模型训练
模型训练

AI大模型:什么是微调?

模型训练
模型训练
模型训练

实战 Transformers 模型微调之数据集处理库 Hugging Face Datasets

模型训练
模型训练
模型训练

MAGPIE:基于自回归LLM的大规模指令数据集自动生成方法