JOTO
Contact us
← AI 智库
模型与技术专题

模型训练

整理模型训练相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

857 篇高质量内容
模型训练
模型训练
模型训练

什么时候需要训练和微调属于自己的大模型——小微企业必须要明白的问题

模型训练
模型训练
模型训练

如何进行大模型训练和微调?(实战)

模型训练
模型训练
模型训练

o1模型在ARC挑战赛的评测与分析

模型训练
模型训练
模型训练

大模型微调: SFT 经验分享

模型训练
模型训练
模型训练

OpenAI o1模型推理能力大幅提升的背后:重复采样如何提升AI推理能力

模型训练
模型训练
模型训练

解析 Llama-Factory:从微调到推理的架构

模型训练
模型训练
模型训练

GPT4+prompt ≈ GPT o1 ? 都2024了, 还在微调、自训练模型?

模型训练
模型训练
模型训练

9 款 GPU 横评,哪些适合大模型训练,哪些适合推理任务?

模型训练
模型训练
模型训练

OpenAI o1 代码能力实战篇

模型训练
模型训练
模型训练

跳过GPT-5 ,OpenAI 推出全新 AI模型 o1

模型训练
模型训练
模型训练

OpenAI o1-mini:优化成本效益的高效推理模型

模型训练
模型训练
模型训练

IBM 全新发布:PowerLM-3B 和 PowerMoE-3B 模型的突破性进展!

模型训练
模型训练
模型训练

「草莓」实测:可能只是工程 Trick,且有扣费陷阱!

模型训练
模型训练
模型训练

什么是 Microsoft Copilot?如何访问和使用

模型训练
模型训练
模型训练

通义灵码企业代码补全增强使用实践

模型训练
模型训练
模型训练

使用 LoRA 对 Gemma 2 进行微调,以纳入 Rust 官方文档

模型训练
模型训练
模型训练

从弱到强的泛化:弱监督激发强大能力(下)

模型训练
模型训练
模型训练

从弱到强的泛化:弱监督激发强大能力(上)

模型训练
模型训练
模型训练

通过监督微调,为LLM注入新知识

模型训练
模型训练
模型训练

微调框架Llama-factory和Unsloth:应该选择哪个?