这里推荐一个本地微调大模型的框架。
ZO2,一个仅用18G显存就能全参微调175B大模型的框架(当然也支持微调小一些的模型)。
更新:现在ZO2支持Qwen3啦,全参微调32B的版本只需要6GB显存。
Code: ***s://github***/liangyuwang/zo2 Paper: ***s://arxiv.org/abs/2503.12668。
上一篇:用GraphQL如何实现以下API请求?与REST的思路相比实现方法孰优孰劣?!
下一篇:NAS的盘是否需要一次性买齐?
这里推荐一个本地微调大模型的框架。
ZO2,一个仅用18G显存就能全参微调175B大模型的框架(当然也支持微调小一些的模型)。
更新:现在ZO2支持Qwen3啦,全参微调32B的版本只需要6GB显存。
Code: ***s://github***/liangyuwang/zo2 Paper: ***s://arxiv.org/abs/2503.12668。
上一篇:用GraphQL如何实现以下API请求?与REST的思路相比实现方法孰优孰劣?!
下一篇:NAS的盘是否需要一次性买齐?