JOTO
Contact us
← AI 智库
模型与技术专题

模型训练

整理模型训练相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

857 篇高质量内容
模型训练
模型训练
模型训练

搞大模型等于洗数据?谈LLM的数据工程

模型训练
模型训练
模型训练

8B尺寸达到GPT-4级性能!北大等提出医疗专家模型训练方法

模型训练
模型训练
模型训练

2024年:大模型训练数据白皮书

模型训练
模型训练
模型训练

基于 Qwen2 大模型微调技术详细教程(LoRA 参数高效微调和 SwanLab 可视化监控)

模型训练
模型训练
模型训练

RegMix-用回归任务解决大模型数据混合问题

模型训练
模型训练
模型训练

如何微调大型语言模型 LLM or GPT

模型训练
模型训练
模型训练

RAG优化必备:如何微调自己的嵌入模型

模型训练
模型训练
模型训练

大模型训练完成之后可以直接使用吗?该怎么使用训练好的大模型?

模型训练
模型训练
模型训练

大模型二次开发基本思路

模型训练
模型训练
模型训练

大语言模型的微调策略

模型训练
模型训练
模型训练

对齐全量微调!这是我看过最精彩的LoRA改进

模型训练
模型训练
模型训练

聊聊GLM-4-9B开源模型的微调loss计算

模型训练
模型训练
模型训练

北大千问团队推出数学专用版CriticGPT,“找茬”让大模型进步更快

模型训练
模型训练
模型训练

DifySandbox 的构建背景和实现机制

模型训练
模型训练
模型训练

万字综述 10+ 种 LLM 投机采样推理加速方案

模型训练
模型训练
模型训练

FP8 低精度训练:Transformer Engine 简析

模型训练
模型训练
模型训练

使用 Azure AI Studio(国际版)负责任地开发和部署生成式智能应用

模型训练
模型训练
模型训练

微调神器LLaMA-Factory官方保姆级教程来了,从环境搭建到模型训练评估全覆盖

模型训练
模型训练
模型训练

大模型微调方案设计和能力整合

模型训练
模型训练
模型训练

不到那一步,绝不 SFT(监督微调)