1. 小米|Xiaomi‑TabLDM开源:表格数据也开始采用通用基础模型
发布时间:2026-09-05 10:10(北京时间)
事件时间:2026-09-05(媒体报道正式发布;论文9月3日提交)
已确认事实:小米发布并开源通用表格数据基础模型Xiaomi‑TabLDM,面向分类和回归任务,通过上下文学习跨数据集使用,无需为每张表单独微调。论文称模型完全使用结构因果模型生成的合成数据预训练,并引入三阶段训练与稀疏MoE。
事件背景:企业数据的大头仍是表格,传统方案常依赖XGBoost、LightGBM和按数据集调参;表格基础模型试图复用预训练能力。
分析判断:这类模型若能稳定跨行业迁移,会把“每表一模型”的项目制成本压成通用推理服务,但外部有效性和数据漂移仍是硬门槛。
对竞争格局或产业链的潜在影响:金融、制造、零售与风控团队可能减少重复训练;云与数据库厂商会把表格模型嵌入AutoML和数据平台。
尚待观察:更多真实企业数据集复现;缺失值、类别漂移和合规数据的处理;推理成本与传统GBDT的正面对比。
一句话辣评:表格模型的胜负不在榜单多一分,而在能否让成千上万张业务表少做一次定制训练。