AI星际引擎
AI STARSHIP
首页
动态
博客
播客
论文
学习
关于
墨
纸
2026.10.01 星期四
第
56
期
主题 · 模型框架
模型框架
1 条
01
LongHarness Bench:面向长上下文推理的语言模型框架压力测试基准
构建首个兼顾有效性与效率的长上下文框架评测基准,覆盖多样检索策略,暴露现有方法性能饱和与成本盲区。
arxiv.org
·
arXiv
·
2天前
基准测试
长上下文
模型框架