merge: 合并 test 分支到 master
Transformer-on-Metax 用于在沐曦 GPU 上学习、运行和扩展 Transformer。 仓库按版本目录管理不同阶段的实现,每个版本独立保存模型代码、数据预处理、 训练、推理、运行脚本和说明文档,便于对照学习与后续扩展。
V1 是对 2017 年论文 Attention Is All You Need 中 Encoder–Decoder Transformer 的 PyTorch 复现,包含 Multi30k 德语→英语和 Tatoeba 英语→中文两个翻译任务,支持数据预处理、模型训练、测试集翻译和交互式推理。 详细的目录结构、运行教程和模型说明请查看 Transformer_V1/README.md。
后续实现将以 Transformer_V2/ 等新的高层目录继续增加,避免影响已有版本的代码和实验结果。
Transformer_V2/
在沐曦c500上逐步实现transformer的详细教程
版权所有:中国计算机学会技术支持:开源发展技术委员会 京ICP备13000930号-9 京公网安备 11010802047560号
Transformer-on-Metax
仓库介绍
Transformer-on-Metax 用于在沐曦 GPU 上学习、运行和扩展 Transformer。 仓库按版本目录管理不同阶段的实现,每个版本独立保存模型代码、数据预处理、 训练、推理、运行脚本和说明文档,便于对照学习与后续扩展。
代码版本
Transformer_V1
V1 是对 2017 年论文 Attention Is All You Need 中 Encoder–Decoder Transformer 的 PyTorch 复现,包含 Multi30k 德语→英语和 Tatoeba 英语→中文两个翻译任务,支持数据预处理、模型训练、测试集翻译和交互式推理。 详细的目录结构、运行教程和模型说明请查看 Transformer_V1/README.md。
后续实现将以
Transformer_V2/等新的高层目录继续增加,避免影响已有版本的代码和实验结果。