本次和大家分享一个非常热门的应用ultralytics,Ultralytics 开发的 YOLO 是一个高效、灵活的开源目标检测框架,支持 YOLO多个版本。它专注于实时目标检测任务,同时扩展了图像分类、实例分割、姿态估计等多种功能。使用场景有监控、工业质检、物流识别管理等等,YOLO的功能很强大,用途很广。

ultralytics整合包使用说明
软件下载解压后直接双击【启动软件.exe】即可打开UI界面。
首先选择待处理文件,可以是图片或视频的路径地址,如果选择处理摄像头内容的话输入框里填0
保存位置即处理结果保存目录
模型即yolo模型
置信度阈值就是物体识别检测结果是否更可靠更接近1,如果识别物体值低于这个值的话就不标记处理。置信度阈值范围(0~1),自己操作一下就明白效果了。
IoU 阈值(0~1)用于衡量预测的边界框与真实目标的边界框之间的重叠程度。
其中:
- iou=0.5 (默认值):如果两个框的 IoU > 0.5,较低置信度的框会被过滤掉
- iou=0.3 (更严格):会保留更多框,可能导致重复检测
- iou=0.7 (更严格):只保留重叠度非常高的框
- 提高 IoU 阈值(0.7~0.9) → 减少重复框,但可能会 丢失一些目标
- 降低 IoU 阈值(0.3~0.5) → 保留更多目标,但可能会 产生多个重叠的框
说起来有些抽象,还是需要自己去实际使用一下体会体会
指定类别就是你想要检测什么物体,0人,1自行车,2汽车,只检测人的话这里就填0,人和汽车,这里就填0,2,用英文逗号隔开。
YOLO物体类别代码如下:
点击展开详细内容>>
| 索引 | 类别名称 | 索引 | 类别名称 | 索引 | 类别名称 |
|---|---|---|---|---|---|
| 0 | person(人) | 1 | bicycle(自行车) | 2 | car(汽车) |
| 3 | motorcycle(摩托车) | 4 | airplane(飞机) | 5 | bus(公交车) |
| 6 | train(火车) | 7 | truck(卡车) | 8 | boat(船) |
| 9 | traffic light(红绿灯) | 10 | fire hydrant(消防栓) | 11 | stop sign(停车标志) |
| 12 | parking meter(停车计时器) | 13 | bench(长凳) | 14 | bird(鸟) |
| 15 | cat(猫) | 16 | dog(狗) | 17 | horse(马) |
| 18 | sheep(羊) | 19 | cow(牛) | 20 | elephant(大象) |
| 21 | bear(熊) | 22 | zebra(斑马) | 23 | giraffe(长颈鹿) |
| 24 | backpack(背包) | 25 | umbrella(雨伞) | 26 | handbag(手提包) |
| 27 | tie(领带) | 28 | suitcase(行李箱) | 29 | frisbee(飞盘) |
| 30 | skis(滑雪板) | 31 | snowboard(单板滑雪) | 32 | sports ball(球) |
| 33 | kite(风筝) | 34 | baseball bat(棒球棒) | 35 | baseball glove(棒球手套) |
| 36 | skateboard(滑板) | 37 | surfboard(冲浪板) | 38 | tennis racket(网球拍) |
| 39 | bottle(瓶子) | 40 | wine glass(酒杯) | 41 | cup(杯子) |
| 42 | fork(叉子) | 43 | knife(刀) | 44 | spoon(勺子) |
| 45 | bowl(碗) | 46 | banana(香蕉) | 47 | apple(苹果) |
| 48 | sandwich(三明治) | 49 | orange(橙子) | 50 | broccoli(西兰花) |
| 51 | carrot(胡萝卜) | 52 | hot dog(热狗) | 53 | pizza(披萨) |
| 54 | donut(甜甜圈) | 55 | cake(蛋糕) | 56 | chair(椅子) |
| 57 | couch(沙发) | 58 | potted plant(盆栽) | 59 | bed(床) |
| 60 | dining table(餐桌) | 61 | toilet(厕所) | 62 | TV(电视) |
| 63 | laptop(笔记本电脑) | 64 | mouse(鼠标) | 65 | remote(遥控器) |
| 66 | keyboard(键盘) | 67 | cell phone(手机) | 68 | microwave(微波炉) |
| 69 | oven(烤箱) | 70 | toaster(烤面包机) | 71 | sink(洗手池) |
| 72 | refrigerator(冰箱) | 73 | book(书) | 74 | clock(时钟) |
| 75 | vase(花瓶) | 76 | scissors(剪刀) | 77 | teddy bear(泰迪熊) |
| 78 | hair drier(吹风机) | 79 | toothbrush(牙刷) | – | – |
GPU加速就是是否使用显卡来加快处理
保存裁剪后的目标就是只保存识别出来的目标
YOLO格式结果就是是否以txt文档保存YOLO格式的识别结果
注意事项
整合包只支持Windows 10或11系统
软件运行路径中不要有非英文字符和空格
ultralytics物体实时目标识别检测软件整合包下载链接
相关推荐
AI描述万物软件describe-anything整合包,精准描述图片视频中指定区域内容
LTX-2.3 视频生成免安装部署整合包软件下载
FlashVSR低分辨率模糊视频高清放大工具整合包v1.1下载,免安装一键启动
人物动作迁移及视频人物替换软件Wan2.2-Animate-14B整合包下载,动作模仿视频换主体工具在线一键启动
无限长度的数字人对话视频生成软件InfiniteTalk整合包,图像转视频、视频配音对口型工具
Wan2.2-S2V-14B:音频驱动图片转视频生成本地整合包及在线一键启动
2D照片转3D视频软件stable-virtual-camera免安装一键启动整合包下载
免费AI视频生成软件FramePack整合包下载,本地离线AI图片转视频工具
最近更新

LTX-2.3 视频生成免安装部署整合包软件下载
LTX-2 是由 Lightricks 开发的首个基于 DiT(扩散变换器)架构的音视频基础模型,能够在一个统一模型中同时生成高质量的视频与同步音频。与以往需要分别处理视频和音频的方案不同,LTX-2 将两者深度融合,实现真正的音画同步生成...
windows电脑剪贴板内容管理工具Ditto下载,快速粘贴预设文字内容回复话术
和大家分享一个windows电脑剪贴板内容管理神器Ditto,软件可以快速将预设文字内容填充到指定位置。 由于每天都要写大量文字,有时候还是重复内容,频繁到其它地方复制粘贴的话比较耗时间,所以找到了这款软件,首先佩服一下软件作者,这个软件维...
PDF转word软件FreeP2W免安装版下载
这软件还是很早的时候一个用户让做的,发现没分享过,现在分享一下。 软件主要功能就是把PDF文档转换为word文档 软件使用很简单,把需要处理的pdf文档复制到input文件夹内,双击启动软件.exe,等待处理完成即可。 注意事项 软件只支持...

多人对话有声书制作软件VoxCPM Windows版整合包,高质量声音克隆语音合成工具
前几天调试了刚出的omnivoice,本次再分享一个语音合成(TTS)领域的开源天花板——VoxCPM。我基于原版功能增加了多人对话语音合成功能,因为之前分享的时候有用户有多人对话语音合成需求,这次顺便增加了这个功能。 一、 什么是 Vox...

图片/PDF转HTML/Markdown/JSON软件Chandra—— Windows 版一键启动包,免安装部署,可离线
日常工作和学习中,我们经常需要把 PDF 文档或复杂的图片(包含表格、公式、排版)转换成可编辑的文本。传统的 OCR 软件往往对复杂排版和表格无能为力,Chandra 2对于多语言文档处理表现更加优秀。 今天向大家推荐一款基于多模态大模型的...

【免安装/解压即用】支持600+语言的神级TTS!OmniVoice 零样本语音克隆一键整合包发布
今天为大家带来一款基于近期爆火的开源语音大模型项目 OmniVoice 制作的免安装、纯离线、一键启动整合包!小白也能在自己的电脑上轻松体验当前地表最强的零样本语音克隆技术! 🎯 一、 什么是 OmniVoice?它有多强? OmniVoi...

FunASR语音识别转文字软件区分说话人版
FunASR是一款优秀的基础语音识别框架,配合阿里通义团队开发的其它语音识别模型,能够实现非常好语音转文字效果,尤其在中文语音识别方面,鉴于有些用户需要对语音识别内容区分说话人,我重新做了一版区分说话人的版本。软件支持多语言识别,但是还是尽...

windows系统电脑通过WSL2安装OpenClwa实现开机自动启动详细教程
windows系统原生环境下运行openclaw多少还是会遇到点问题,虽然windows原生环境支持使用,但是WSL2仍是官方最推荐的方式。下面是windows系统电脑安装WSL2及OpenClaw详细教程。 安装 WSL2 以管理员身份打...

openclaw AI助手windows电脑安装部署及微信聊天配置详细教程
openclaw是目前最火爆的开源应用,没有之一,它功能强大远超同类应用。以前AI只是你问它答,OpenClaw可以说是有了手,可以帮你做事,做很多事,如果利用的好,绝对是个利器。下面分享一下windows系统电脑本地安装部署教程,有时候可...

Apple苹果3D 高斯(3DGS)模型ply文件生成器,图片转3D模型软件下载
ml-sharp是Apple苹果团队开发的一款3D高斯(3DGS)生成器,可将图片生成3D效果的ply文件。我基于当前最新版本制作了免安装一键启动整合包。 ml-sharp官方介绍 我们提出了 SHARP,这是一种从单张图像进行照片级逼真视...













