H2O-Lightning-4B
H2O.ai 的 4B 决策模型,基于 Qwen3.5-4B。除文本外,从 v1.2 起还能对随记录一起传入的图像(照片、截图、扫描件、图表)提问,每个选项都返回概率。可以在未修改的 vLLM 0.30.0 上配一个标准库 shim 直接跑;每次决策一次前向、只输出一个 token,所以成本只算输入 token。官方称在 JevBench v1.6.1 开放权重榜的 Composite 上排第 1(72.5,高于 Jev 的 71.5),也领先所有开放的 12B / 26B / 31B 模型——4B 的体量主要靠校准与成本拿到这个名次。
该模型目前没有出现在 S1MB 或 Decision Index 的公开评测结果中。
模型信息
- 厂商
- H2O.ai
- 类别
- 开源权重
- 参数规模
- 4.5B
- 基座模型
- Qwen/Qwen3.5-4B
- 权重
- 可下载(开源)
- 许可证
- Apache-2.0 可商用
- 输入模态
- 文本 图像
- 决策原语
- ChoiceNoulScore
- 可微调
- 可以
- 微调方法
- 基于 Qwen3.5-4B 微调;仓库内含 LoRA adapter(adapter/),可以在此基础上继续二次微调