小米9月5日正式发布通用表格数据基础大模型Xiaomi-TabLDM并宣布开源,模型权重、代码与技术报告全部公开,主打一次预训练后无需针对每份数据集重新训练即可完成分类与回归预测任务。
该模型采用大规模合成数据预训练、双流特征分组等方案,在TALENT、OpenML-CTR23等基准测试中处于第一梯队,其中回归能力登顶OpenML-CTR23;据称推理开销低于传统方案,工业场景材料性能预测精度提升明显。
面向金融、医疗、制造、物流等行业大量存在的表格结构化数据场景,Xiaomi-TabLDM被视为以基础模型范式替代XGBoost、LightGBM等传统机器学习方案的又一次尝试。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。