微信扫码
与创始人交个朋友
我要投稿
Paper:YOLO-World: Real-Time Open-Vocabulary Object Detection
Abs:https://arxiv.org/abs/2401.17270
Code:https://github.com/AILab-CVC/YOLO-World
在自然图像与视频目标检测与识别领域,传统方法通常在预定义类别的数据集上训练,无法识别数据集中未出现的目标类别,缺乏零样本检测能力,识别能力有限。
来自Tencent AI Lab、ARC Lab、Tencent PCG 以及华中科技大学的研究者们在 CVPR 2024 上提出了基于视觉语言建模的开放词汇YOLO-World模型,并探索针对YOLO检测器的大规模数据预训练方法,赋予 YOLO 模型零样本检测能力与语言理解能力,在推理速度和零样本检测精度上均领先先前工作。
YOLO-World模型目前已经在腾讯内部多项业务中落地,并与海外多家公司达成商业合作。
53AI,企业落地应用大模型首选服务商
产品:大模型应用平台+智能体定制开发+落地咨询服务
承诺:先做场景POC验证,看到效果再签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2024-09-19
o1 能带我们走进 AGI 吗?
2024-09-19
解锁医疗新未来:Sunsimiao-7B 中文医疗大模型震撼登场
2024-09-19
36%的国资央企组建大模型团队,沙丘智库发布《2024年国资央企大模型应用跟踪报告》
2024-09-18
AI大模型实战篇:LATS,可能是目前最强的AI Agent设计框架
2024-09-18
360视角:大模型幻觉问题及其解决方案的深度探索与实践
2024-09-18
太爽了!o1 现在可以天天享用了
2024-09-18
Claude Artifacts 数据分析的N种打开方式(附Prompt)
2024-09-18
如何微调(Fine-tuning)大语言模型?
2024-07-18
2024-03-30
2024-04-26
2024-04-11
2024-05-06
2024-06-12
2024-05-09
2023-07-01
2024-07-07
2024-07-25