cover

走马

陈粒

多智能体记忆笔记
记忆是智能体积累经验并透过与环境交互探索世界的主要驱动力。
Cover Image of the Post
大模型微调学习笔记
最近在系统学习大模型微调,从为什么需要微调开始,一路梳理 SFT、LoRA、QLoRA、DPO 等常见方法,再到数据准备、训练流程、效果评估和实践中的踩坑记录。先把概念框架搭起来,后面再慢慢补充自己的实验过程。
Cover Image of the Post
Profile Image of the Author
R1ng13
Hello, I'm R1ng13.
📢 欢迎来访者
👋🏻 Hi,我是R1ng13,欢迎您!
分类
标签
站点统计
文章
2
分类
2
标签
7
总字数
4,396
运行时长
0
最后活动
0 天前
站点信息
构建平台
EdgeOne
博客版本
Firefly v6.12.3
文章许可
CC BY-NC-SA 4.0
音乐
封面

音乐

暂未播放

0:00 0:00
暂无歌词
--%
本年还剩 -- 天
--%
本月还剩 -- 天
--%
本周还剩 -- 天

距离 --

--

--

我和宝宝在一起已经
---------CSB ❤️ YSY---------
---------CSB
❤️
YSY---------
0 0 0 0 0 00
✨ 今日一言
" 人生如骑自行车,要保持平衡就必须不断前进。 "
—— 爱因斯坦
天气预报
统计

文章目录

✨️ 复制成功,转载请标注本文地址