首页
学习
活动
专区
圈层
工具
发布
    • 综合排序
    • 最热优先
    • 最新优先
    时间不限
  • 来自专栏机器学习与推荐算法

    推荐系统embedding过大如何压缩?

    量化是通过对值精度维度压缩,把神经网络中参数存储格式从FP32-32位浮点降低为更低精度表示(FP16-16位浮点、INT8-8位定点整数、INT4-4位定点整数)数值格式,在线上推理时再通过反量化(恢复回

    2.8K20编辑于 2023-09-22
领券