training

微调

本文介绍了微调的常见挑战及其克服方法,并详细介绍了如何使用Unsloth在消费级GPU上对DeepSeek-R1进行微调。
training

微调

本文介绍了微调的常见挑战及其克服方法,并详细介绍了如何使用Unsloth在消费级GPU上对DeepSeek-R1进行微调。
📅 2025-02-26 ⏱️ 3 分钟 📝 480 字
#training #finetuning #DeepSeek-R1
papers

DeepSeek R1 论文解读

本文介绍了深度求索(DeepSeek)公司推出的新一代推理模型DeepSeek-R1,并对其技术原理、主要贡献、论文方法、评估结果和局限性进行了详细解读。
papers

DeepSeek R1 论文解读

本文介绍了深度求索(DeepSeek)公司推出的新一代推理模型DeepSeek-R1,并对其技术原理、主要贡献、论文方法、评估结果和局限性进行了详细解读。
📅 2025-02-10 ⏱️ 3 分钟 📝 562 字
#AI #深度思考 #DeepSeek-R1