微信扫码
添加专属顾问
我要投稿
Qdrant 在前几天发起了一些重大声明,提到创造了一个新的算法,命名为BM42,用以取代古老的 BM25(甚至更现代的 SPLADE算法)。
对Qdrant不熟悉的小伙伴,提一点,Qdrant是目前OpenAI正在使用的向量库,所以说明各方面可信度都挺高的。
在他们的帖子中,提到:BM25已经统治了搜索引擎40年了,但是BM25在最新的RAG应用场景表现并不好,所以快来看我们的新算法BM42-一个结合语义和关键词的搜索算法。
通过将单词重要性评分(transformer注意力)与IDF等统计指标相结合来解决语义+关键字搜索的问题,声称在各个场景都有优势,如下图
很快,来自 Vespa(竞品公司)的 @Jo Bergum 指出 Quora作为数据集是非常奇怪的,因为这是一个检测句子相似重复的数据集,而不是问答检索数据集。具体点呢,就是 Quora 数据集每个query只有约 1.6 个相关的候选,因此评测种的 precision@10 结果显然是错误的,声称每 10 个query中有4个候选。
最新,Cohere 的 @Nils Reimers 使用 BM42, 在金融、生物医学和维基百科领域的更好数据集上重新运行,遗憾的是 BM42 在所有方面都表现不佳:
Qdrant最新的公关回复,对结果进行了修正,并推送了最新的修正后的代码。但是仍然被质疑评测的BM25分数太低,正常可能能达到0.91。
算是最新的大瓜了,早上刷到了很多帖子。天气太热,吃瓜消遣一下~
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-01-12
“基模四杰”开年首炸:Chat已死,Agent已来
2026-01-11
Anthropic联创:还不存在真正递归自我改进的AI!曝内部调查结果:AI未必能实现开发效率爆炸式增长;Claude也能修水管,看好分布式预训练
2026-01-11
Claude Skill 快照:给你的 AI 技能迭代加个「后悔药」
2026-01-11
Step-DeepResearch:深度研究的全能选手,规划、检索、反思一网打尽!
2026-01-11
静态分析只能查规则,AI 才能懂语义:PR-Agent 和 ESLint/Sonar 的正确分工
2026-01-11
订阅 Google One,一个人交钱六个人用 Gemini Pro
2026-01-11
你的Excel已觉醒!AI-by-Hand-Excel如何将普通表格变成超级智能助手?
2026-01-10
别开发智能体,开发Skills!介绍 Skill0.IO
2025-10-26
2025-11-19
2025-10-20
2025-11-13
2025-10-18
2025-10-21
2025-10-15
2025-11-03
2025-10-23
2025-10-22
2026-01-11
2026-01-10
2026-01-10
2026-01-08
2026-01-02
2025-12-31
2025-12-31
2025-12-31