训练成果交付
AI 模型、检查点和数据集怎么传?
一个模型往往不只有权重文件,还依赖配置、分词器、分片索引、校验值和运行说明。交给同事时把这些内容放在同一目录,比单独发送最大的权重文件更可靠。
直接答案
按“模型、配置、分词器、示例、校验与说明”整理目录,删除不应共享的数据和凭证,再选择文件或完整文件夹传输。对方收到后先校验文件,再按说明加载。
模型目录里通常要包含什么?
- 权重或分片检查点,以及对应的索引文件。
- 模型配置、分词器、预处理参数和依赖版本。
- 哈希校验值、许可证、数据使用限制和来源说明。
- 最小加载示例,以及训练或量化方式的必要说明。
传输前先处理敏感内容
检查训练数据是否包含个人信息、商业秘密或受限制内容,确认你有权发送模型和数据集。删除 API 密钥、访问令牌、实验跟踪凭证和本地缓存。点对点传输不会替你完成权限审核。
大型权重和分片目录可以一起传
桌面 Chrome 和 Edge 支持最高 200 GB 的单文件,也支持最多 20,000 个文件的文件夹。适合把 safetensors、检查点分片、配置和测试样例一次交给当前在线的同事。
什么时候应使用模型仓库或对象存储?
需要版本管理、访问控制、长期下载、多人协作或自动部署时,应使用团队批准的模型仓库、数据平台或对象存储。8码快传适合双方在线时的一次性交付,不代替模型注册表。