AI星际引擎AI STARSHIP
2026.10.01 星期四
第 56 期
主题 · 模型框架

模型框架

1 条
  1. 01
    LongHarness Bench:面向长上下文推理的语言模型框架压力测试基准

    构建首个兼顾有效性与效率的长上下文框架评测基准,覆盖多样检索策略,暴露现有方法性能饱和与成本盲区。

    arxiv.org·arXiv·2天前基准测试长上下文模型框架