Tiny LLM 76m 对话模型示例_开源AI项目-程序员客栈

开源地址
https://modelscope.cn/models/wdndev/tiny_llm_sft_76m_llama授权协议
Apache License 2.0

Tiy LLM 76M SFT

简介

本项目wddev/tiy-llm-zh (github.com)旨在构建一个小参数量的中文语言大模型，用于快速入门学习大模型相关知识。

模型架构：整体模型架构采用开源通用架构，包括：RMSNorm，RoPE，MHA等

实现细节：实现大模型两阶段训练及后续人类对齐，即：预训练(PTM) -> 指令微调(SFT) -> 人类对齐(RLHF, DPO) -> 测评。

注意：因资源限制，本项目的第一要务是走通大模型整个流程，而不是调教比较好的效果，故评测结果分数较低，部分生成错误。

注意：此模型采用扩充 llama2 的词表后进行训练的；使用 tiyllmsft_92m 模型初始化trasformers层，随机初始化embeddig层，继续训练10B 的toke，微调后得到；

模型细节

大约在9B的中文预料中训练，主要包含百科内容，模型架构采用开源通用架构，包括：RMSNorm，RoPE，MHA等。

环境

只需要安装 trasformers 即可运行

快速开始

from trasformers import AutoTokeizer, AutoModelForCausalLM

model_id = "wddev/tiy_llm_sft_76m_llama"

tokeizer = AutoTokeizer.from_pretraied(model_id)
model = AutoModelForCausalLM.from_pretraied(model_id, device_map="auto", trust_remote_code=True)

sys_text = "你是由wddev开发的个人助手。"
# user_text = "中国的首都是哪儿？"
# user_text = "你叫什么名字？"
user_text = "介绍一下中国"
iput_txt = "\".joi(["<|system|>", sys_text.strip(), 
                        "<|user|>", user_text.strip(), 
                        "<|assistat|>"]).strip() + "\"

model_iputs = tokeizer(iput_txt, retur_tesors="pt").to(model.device)
geerated_ids = model.geerate(model_iputs.iput_ids, max_ew_tokes=200)
geerated_ids = [
    output_ids[le(iput_ids):] for iput_ids, output_ids i zip(model_iputs.iput_ids, geerated_ids)
]
respose = tokeizer.batch_decode(geerated_ids, skip_special_tokes=True)[0]
prit(respose)

Tiny LLM 76M SFT 简介本项目wdndev/tiny-llm-zh (github.com)旨在构建一个小参数量的中文语言大模型，用于快速入门学习大模型相关知识。模型架构：整体模型架

声明：本文仅代表作者观点，不代表本站立场。如果侵犯到您的合法权益，请联系我们删除侵权资源！如果遇到资源链接失效，请您通过评论或工单的方式通知管理员。未经允许，不得转载，本站所有资源文章禁止商业使用运营!

下载安装【程序员客栈】APP

实时对接需求、及时收发消息、丰富的开放项目需求、随时随地查看项目状态

前往安装

Tiny LLM 76m 对话模型示例

技术信息

作品详情

Tiy LLM 76M SFT

简介

模型细节

环境

快速开始

功能介绍

重点城市程序员兼职推荐

重点岗位程序员兼职推荐