【开源实习】泰语语种的多模态数据资源在昇腾AI开发板上运行应用 #1728#138
Conversation
|
辛苦代码合入master分支的orange-pi-mindspore/Online/community目录下,项目目录和代码文件命名格式参考代码仓中已有项目的格式;同时目录orange-pi-mindspore/Online/,orange-pi-mindspore/Online/community/下的readme文件对应位置补充该项目的相关版本信息 |
|
.py文件转换成.ipynb文件,另外readme文件需要改成markdown |
|
mindnlp支持直接加载safetensors ,无须把 safetensors 转成 pytorch bin 格式吧? |
|
老师我之前试过直接加载 safetensors,但是MindNLP 0.4.1 在读取 wongwian-micro-instruct 的 safetensors 文件时报错:报错原因是metadata 解析失败,然后才转换为 pytorch_model.bin的 |
|
检查一下safetensors权重文件是否是完整的? |
老师,我刚看了一下,safetensors文件是完整的,是从 HuggingFace 正常下载的 |
老师,这个修改完成了,麻烦您看一下 |
|
老师,我对比了一下 SHA256 哈希值,本地下载的文件与 HuggingFace 原始文件是一样的 |
e5fdc1f to
2a0a8b5
Compare
5be094f to
b3509ab
Compare
|
验收通过,可以合入 |






泰语多模态推理应用
本PR为昇腾AI开发板添加了泰语语种的多模态数据资源运行应用。
任务链接:https://gitcode.com/mindspore/community/issues/1728
新增内容
技术特性
注意事项
pytorch_model.bin文件因大小限制(517MB > 100MB)暂未包含测试环境
这个应用扩展了项目对泰语的支持,为多语言AI应用开发提供了参考实现。