本次和大家分享一个非常热门的应用ultralytics,Ultralytics 开发的 YOLO 是一个高效、灵活的开源目标检测框架,支持 YOLO多个版本。它专注于实时目标检测任务,同时扩展了图像分类、实例分割、姿态估计等多种功能。使用场景有监控、工业质检、物流识别管理等等,YOLO的功能很强大,用途很广。

ultralytics整合包使用说明
软件下载解压后直接双击【启动软件.exe】即可打开UI界面。
首先选择待处理文件,可以是图片或视频的路径地址,如果选择处理摄像头内容的话输入框里填0
保存位置即处理结果保存目录
模型即yolo模型
置信度阈值就是物体识别检测结果是否更可靠更接近1,如果识别物体值低于这个值的话就不标记处理。置信度阈值范围(0~1),自己操作一下就明白效果了。
IoU 阈值(0~1)用于衡量预测的边界框与真实目标的边界框之间的重叠程度。
其中:
- iou=0.5 (默认值):如果两个框的 IoU > 0.5,较低置信度的框会被过滤掉
- iou=0.3 (更严格):会保留更多框,可能导致重复检测
- iou=0.7 (更严格):只保留重叠度非常高的框
- 提高 IoU 阈值(0.7~0.9) → 减少重复框,但可能会 丢失一些目标
- 降低 IoU 阈值(0.3~0.5) → 保留更多目标,但可能会 产生多个重叠的框
说起来有些抽象,还是需要自己去实际使用一下体会体会
指定类别就是你想要检测什么物体,0人,1自行车,2汽车,只检测人的话这里就填0,人和汽车,这里就填0,2,用英文逗号隔开。
YOLO物体类别代码如下:
点击展开详细内容>>
| 索引 | 类别名称 | 索引 | 类别名称 | 索引 | 类别名称 |
|---|---|---|---|---|---|
| 0 | person(人) | 1 | bicycle(自行车) | 2 | car(汽车) |
| 3 | motorcycle(摩托车) | 4 | airplane(飞机) | 5 | bus(公交车) |
| 6 | train(火车) | 7 | truck(卡车) | 8 | boat(船) |
| 9 | traffic light(红绿灯) | 10 | fire hydrant(消防栓) | 11 | stop sign(停车标志) |
| 12 | parking meter(停车计时器) | 13 | bench(长凳) | 14 | bird(鸟) |
| 15 | cat(猫) | 16 | dog(狗) | 17 | horse(马) |
| 18 | sheep(羊) | 19 | cow(牛) | 20 | elephant(大象) |
| 21 | bear(熊) | 22 | zebra(斑马) | 23 | giraffe(长颈鹿) |
| 24 | backpack(背包) | 25 | umbrella(雨伞) | 26 | handbag(手提包) |
| 27 | tie(领带) | 28 | suitcase(行李箱) | 29 | frisbee(飞盘) |
| 30 | skis(滑雪板) | 31 | snowboard(单板滑雪) | 32 | sports ball(球) |
| 33 | kite(风筝) | 34 | baseball bat(棒球棒) | 35 | baseball glove(棒球手套) |
| 36 | skateboard(滑板) | 37 | surfboard(冲浪板) | 38 | tennis racket(网球拍) |
| 39 | bottle(瓶子) | 40 | wine glass(酒杯) | 41 | cup(杯子) |
| 42 | fork(叉子) | 43 | knife(刀) | 44 | spoon(勺子) |
| 45 | bowl(碗) | 46 | banana(香蕉) | 47 | apple(苹果) |
| 48 | sandwich(三明治) | 49 | orange(橙子) | 50 | broccoli(西兰花) |
| 51 | carrot(胡萝卜) | 52 | hot dog(热狗) | 53 | pizza(披萨) |
| 54 | donut(甜甜圈) | 55 | cake(蛋糕) | 56 | chair(椅子) |
| 57 | couch(沙发) | 58 | potted plant(盆栽) | 59 | bed(床) |
| 60 | dining table(餐桌) | 61 | toilet(厕所) | 62 | TV(电视) |
| 63 | laptop(笔记本电脑) | 64 | mouse(鼠标) | 65 | remote(遥控器) |
| 66 | keyboard(键盘) | 67 | cell phone(手机) | 68 | microwave(微波炉) |
| 69 | oven(烤箱) | 70 | toaster(烤面包机) | 71 | sink(洗手池) |
| 72 | refrigerator(冰箱) | 73 | book(书) | 74 | clock(时钟) |
| 75 | vase(花瓶) | 76 | scissors(剪刀) | 77 | teddy bear(泰迪熊) |
| 78 | hair drier(吹风机) | 79 | toothbrush(牙刷) | – | – |
GPU加速就是是否使用显卡来加快处理
保存裁剪后的目标就是只保存识别出来的目标
YOLO格式结果就是是否以txt文档保存YOLO格式的识别结果
注意事项
整合包只支持Windows 10或11系统
软件运行路径中不要有非英文字符和空格
ultralytics物体实时目标识别检测软件整合包下载链接
相关推荐
AI描述万物软件describe-anything整合包,精准描述图片视频中指定区域内容
FlashVSR低分辨率模糊视频高清放大工具整合包v1.1下载,免安装一键启动
人物动作迁移及视频人物替换软件Wan2.2-Animate-14B整合包下载,动作模仿视频换主体工具在线一键启动
无限长度的数字人对话视频生成软件InfiniteTalk整合包,图像转视频、视频配音对口型工具
Wan2.2-S2V-14B:音频驱动图片转视频生成本地整合包及在线一键启动
2D照片转3D视频软件stable-virtual-camera免安装一键启动整合包下载
免费AI视频生成软件FramePack整合包下载,本地离线AI图片转视频工具
免费图片视频摄像头换脸软件VisoMaster整合包下载,面部表情实时调节预览
最近更新

FunASR语音识别转文字软件区分说话人版
FunASR是一款优秀的基础语音识别框架,配合阿里通义团队开发的其它语音识别模型,能够实现非常好语音转文字效果,尤其在中文语音识别方面,鉴于有些用户需要对语音识别内容区分说话人,我重新做了一版区分说话人的版本。软件支持多语言识别,但是还是尽...

windows系统电脑通过WSL2安装OpenClwa实现开机自动启动详细教程
windows系统原生环境下运行openclaw多少还是会遇到点问题,虽然windows原生环境支持使用,但是WSL2仍是官方最推荐的方式。下面是windows系统电脑安装WSL2及OpenClaw详细教程。 安装 WSL2 以管理员身份打...

openclaw AI助手windows电脑安装部署及微信聊天配置详细教程
openclaw是目前最火爆的开源应用,没有之一,它功能强大远超同类应用。以前AI只是你问它答,OpenClaw可以说是有了手,可以帮你做事,做很多事,如果利用的好,绝对是个利器。下面分享一下windows系统电脑本地安装部署教程,有时候可...

Apple苹果3D 高斯(3DGS)模型ply文件生成器,图片转3D模型软件下载
ml-sharp是Apple苹果团队开发的一款3D高斯(3DGS)生成器,可将图片生成3D效果的ply文件。我基于当前最新版本制作了免安装一键启动整合包。 ml-sharp官方介绍 我们提出了 SHARP,这是一种从单张图像进行照片级逼真视...

字节跳动Dolphin图片文档解析工具免安装一键启动整合包下载,PDF转JSON/Markdown软件
本次再分享一个由字节跳动团队开发的一款图片文档解析工具Dolphin,支持解析表格、公式、文本、代码块等元素,支持图片和PDF文档转为Markdown和JSON格式文件,当前为最新发布的V2版本,各项功能效果都得到较大提升。 Dolphin...

微软最新图片转3D网格模型软件TRELLIS.2 windows版整合包下载,AI一键建模工具
上个月微软发布了图片转3D网格模型软件TRELLIS的2.0版本。之前1.0版本非常受欢迎,当前2.0版本功能更强大,效果更好。我制作了最新windows版免安装一键启动整合包。 TRELLIS.2官方说明 TRELLIS.2 是一款最先进...

FunASR最新模型FunAudioLLM/Fun-ASR-Nano-2512实时语音识别转文字热词版整合包下载
Fun-ASR-Nano-2512是阿里通义实验室前天刚发布的最新最强的一款语音识别转文字模型,支持31种语言,延迟低,在某些专业领域表现出色。我基于FunAudioLLM/Fun-ASR-Nano-2512模型制作了最新实时语音识别转文字...

Crawl4AI:基于AI大语言模型的网络爬虫和数据抓取工具整合包软件下载
Crawl4AI是一款基于AI大语言模型能力的网络爬虫和数据抓取软件,可以将网页转换为简洁、符合 LLM 规范的 Markdown 格式,适用于 RAG、代理和数据管道。它速度快、可控性强。 Crawl4AI官方介绍 开源的 LLM 友好型...

browser-use浏览器任务全自动化AI助手windows电脑版一键启动整合包
本次再和大家分享一个非常牛逼的AI助手软件:browser-use,别问哪里牛逼,反正很多人都在用,社区starts高达72.8K,火遍全球的deepseek 100K,browser-use 72.8K,就问你火不火。之前我也分享过其它类...

FlashVSR低分辨率模糊视频高清放大工具整合包v1.1下载,免安装一键启动
FlashVSR-一款高性能可靠的视频超高分辨率放大工具。迈向基于扩散的实时流式视频超分辨率——一种高效的单步扩散框架,用于具有局部约束稀疏注意力和小型条件解码器的流式VSR。 FlashVSR官方介绍 扩散模型最近在视频修复方面取得了进展...










