Home
本频道
全频道
🔍
ChatGPT / AI新闻聚合
← 返回
Wednesday, March 29, 2023 8:01 AM
炼丹!训练 stable diffusion 来生成LoRA定制模型
via
掘金 人工智能
(author: 雨田君的记事本)
Telegraph
炼丹!训练 stable diffusion 来生成LoRA定制模型
LoRA,英文全称Low-Rank Adaptation of Large Language Models,直译为大语言模型的低阶适应,这是微软的研究人员为了解决大语言模型微调而开发的一项技术。 比如,GPT-3有1750亿参数,为了让它能干特定领域的活儿,需要做微调,但是如果直接对GPT-3做微调,成本太高太麻烦了。 LoRA的做法是,冻结预训练好的模型权重参数,然后在每个Transformer(Transforme就是GPT的那个T)块里注入可训练的层,由于不需要对模型的权重参数重新计算梯度,所以,大大减少了需要训练的计算量。…
来自频道:
@AI_News_CN
复制
Markdown
HTML
纯文本
分享
Loading comments...
⚠️
评论区加载失败
可能原因:
浏览器广告拦截器阻止了 Telegram widget
网络连接问题
解决方法:
临时禁用广告拦截器(如 AdBlock、uBlock Origin)
或将本站添加到广告拦截器的白名单
或直接访问
Telegram 查看评论
Home
Links
About
ALL-RSS
本频道
全频道
🔍
Powered by
Multi-Channel Fork
inspired by BroadcastChannel
⚠️ 评论区加载失败
可能原因:
- 浏览器广告拦截器阻止了 Telegram widget
- 网络连接问题
解决方法: