-
- 2026/10/6
- 默认分类
微软和其他人发布了一份很棒的论文。如果你运行的是搜索大量文档的代理程序,这份论文绝对值得你花时间读一读。(可以收藏一下)他们介绍了一种叫CorpusMap的技术,可以在文档集合中提前识别重复的实体,并为每个实体创建一个页面,链接到所有提及它- 66阅读
- 0评论
-
- 2026/10/6
- 默认分类
告诉你的代理提前计划真的有用吗?通常的做法是在代理的指令中加入“提前计划”或“考虑其他玩家”的指示。但是,这篇来自哈佛和麻省理工学院的论文在拍卖和匹配市场中发现,这些指示实际上会让整体表现变差。作者使用了有已知最优策略的设置,所以可以评估每- 59阅读
- 0评论
-
- 2026/10/6
- 默认分类
RT Alan Zabihi 今天我们发布了Security-One,这是一个27B参数的开放权重模型,用于安全决策。它会读取文档、工具调用或代码更改,并返回你定义的答案概率。你的代码决定允许、阻拦还是提交审查。- 63阅读
- 0评论
-
- 2026/10/6
- 默认分类
RT Akshay 🚀 HuggingFace 刚刚在多任务工程上填补了一个重要的空白!(终极多任务强化学习指南)同一个开放权重的模型在一个任务框架内表现得很好,但移到另一个框架时可能会失去准确性或产生无效的操作调用。这是因为在一个接口内训- 65阅读
- 0评论