从矩阵乘法到多模态大模型 – LLM 篇

本项目旨在从零搭建一个基于 GPT-2 Medium 衍生架构的 LLaVA 多模态大模型,使其至少支持文本、图像两种模态输入,同时尽可能减少对
Pytorch 封装库的直接调用,在此中熟练掌握基础
Transformer 的知识、模型的预训练微调等等处理技术和对多模态技术的了解。

赞(0)
未经允许不得转载:小狮博客 » 从矩阵乘法到多模态大模型 – LLM 篇
分享到: 更多 (0)

联系我们