logo ModelScope魔搭社区

ModelScope魔搭社区
模型库数据集创空间开发者实践MCP广场AIGC专区Skills科学智能
去全站搜索看看?

登录社区云

登录社区云,与社区用户共同成长

ModelScope魔搭社区

邀请您加入社区

欢迎加入社区

欢迎加入社区

bert
  • 大模型原理与实践:第五章-自己搭建大模型_第3部分-预训练一个小型LLM

    本文介绍了如何预训练一个小型LLM(约2亿参数)的完整流程,包括数据准备、预训练和微调。主要内容: 数据下载与处理:使用出门问问序列猴子数据集(10B tokens)作为预训练数据,BelleGroup中文对话数据集(350万条)作为SFT数据。提供了数据下载脚本和预处理代码,包括文本切分和格式转换。 构建预训练数据集:详细介绍了PretrainDataset类的实现,用于自回归语言建模任务,包含

    xuebinding
    2025-10-08 07:30:00
     1423 
     18 
    #语言模型#人工智能#bert
没有更多了
回到
顶部
logo 提供社区服务与技术支持
logo 提供社区服务与技术支持
©1999-2023北京创新乐知网络技术有限公司 京ICP备19004658号