JOTO
Contact us
← AI 智库
模型与技术专题

模型训练

整理模型训练相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

857 篇高质量内容
模型训练
模型训练
模型训练

一文彻底搞懂Fine-tuning - 超参数(Hyperparameter)

模型训练
模型训练
模型训练

基于LLaMA-Factory框架对Qwen2-7B模型进行微调实践

模型训练
模型训练
模型训练

Kimi+Langchain+FastGPT:文档转LLM微调数据集 / QA问答对生成、Kimi 128KAPI免费接入!

模型训练
模型训练
模型训练

LLM大模型的微调原理以及ChatGPT的API微调操作实践

模型训练
模型训练
模型训练

大模型的训练与调优,SFT(监督微调)和RLHF(基于人类反馈的强化学习)到底是什么?

模型训练
模型训练
模型训练

如何微调Meta Llama-3 8B

模型训练
模型训练
模型训练

InternVL2-4B微调记录

模型训练
模型训练
模型训练

斯坦福惊现“偷师学霸”新模型:不用刷题,性能暴涨50%

模型训练
模型训练
模型训练

常见几种大语言模型压缩技术分析详解

模型训练
模型训练
模型训练

卷起来了,Qwen2-Math重磅来袭,数学能力超越GPT-4o

模型训练
模型训练
模型训练

探索Cohere的Prompt Tuner:革新你的提示优化工具

模型训练
模型训练
模型训练

京东广告稀疏大模型训练与推理 GPU 优化实践

模型训练
模型训练
模型训练

浅谈-领域模型训练

模型训练
模型训练
模型训练

如何让训练更快:GPU 算力评估

模型训练
模型训练
模型训练

用LoRA微调,轻松实现AI模型的动态演化

模型训练
模型训练
模型训练

聊聊如何在内网下构建大模型微调环境

模型训练
模型训练
模型训练

从PEFT到未来:大模型微调的高效新方法全面揭秘!

模型训练
模型训练
模型训练

在这个夏天设置一个多 GPU 的 Linux 机器来搞深度学习

模型训练
模型训练
模型训练

全面解析AI生态系统:微调技术、框架和算力的深度探索

模型训练
模型训练
模型训练

大模型二次开发基本思路