本次再分享一个非常强大的视觉追踪工具SAMURAI,SAMURAI是一个基于Meta推出的Segment Anything Model 2(SAM 2)的改进版本,旨在实现零样本视觉跟踪,特别关注运动感知记忆的适应性。

SAMURAI介绍
本应用是由华盛顿大学华人团队基于Meta的SAM 2的优化升级版。是 SAMURAI 的官方实现:使用运动感知记忆调整任何分段模型以实现零样本视觉跟踪

主要功能:
- 零样本视觉跟踪:无需额外训练,直接利用SAM 2.1的预训练权重进行视觉对象跟踪。
- 运动感知记忆:通过引入卡尔曼滤波器,增强对目标运动的预测能力,提高在复杂场景中的跟踪准确性。
具体使用场景:
- 复杂视频分析:适用于处理快速移动或被遮挡的目标,如体育比赛、舞蹈表演等场景中的对象跟踪。
- 实时监控:在拥挤或动态环境中,对特定目标进行实时跟踪,提升监控系统的智能化水平。
- 人机交互:在增强现实或虚拟现实应用中,实时跟踪用户或物体的运动,提高交互体验的自然性和流畅度。
SAMURAI整合包使用说明
首先到网盘内将软件压缩包下载到电脑上解压。SAMURAI无需自己训练模型,直接使用预训练模型即可。我没有打包模型文件而是做了个模型下载程序,首先运行【模型下载.exe】即可从阿里平台满速下载模型,速度非常快,等到终端窗口界面输出提示模型下载完成即可。
模型下载完成后即可双击运行【启动软件.exe】启动软件操作界面。软件支持处理视频文件和图片序列。你可以将mp4视频文件或是文件夹鼠标左键按住拖动到软件窗口里,软件会自动识别路径并填充到编辑框中。
坐标位置:你需要提供所追踪物体在视频第一帧中的坐标位置,追踪区域为方形,坐标位置的值类似:100,101,102,103。前两个值是这个区域最左上角的顶点的坐标。后两个值是这个区域的宽高尺寸。数值之间使用英文逗号“,”隔开。如果你没有相关获取视频内物体坐标位置的工具的话,你可以看我下面这篇文章参考获取视频内物体坐标位置和尺寸《使用QQ和PotPlayer确定视频中指定区域点的坐标位置和宽高尺寸》
模型选择:理论模型越大效果越好,默认使用plus模型,想要体验更大模型效果的话可以选择large。
点击开始处理按钮即可开始处理视频。等到软件处理完成后会将输出结果视频output.mp4保存到软件项目文件夹内。
处理速度主要受视频尺寸影响,视频尺寸越大处理越慢。
注意事项
开始处理后会首先占用大量CPU和内存,感觉至少应该要预留15G内存,如果内存不足会报not enough memory相关错误。
整合包只支持Windows 10或11系统
软件运行路径中不要有非英文字符和空格
使用前请先将英伟达显卡驱动更新到最新版本,否则可能会报错
建议英伟达显卡显存6G以上用户体验
零样本视觉追踪软件samurai一键启动包下载链接
相关推荐
最近更新

高效可控歌曲生成器ACE-Step一键启动整合包,音乐人的歌曲创作利器
又一款AI歌曲创作利器:ACE-Step,ACE-Step是刚发布不久的AI自动谱曲AI自动演唱软件,软件在歌曲生成速度、音乐连贯性和可控性上相对同类软件有了较大提升。ACE-Step在3小时前刚发布了新版本,我基于当前最新版本制作了免安装...

超逼真对话型文字转语音软件Dia-1.6B免安装一键启动整合包下载
本次分享一个刚出的超逼真对话型文字转语音软件Dia-1.6B,这个TTS软件不像传统的文字转语音那样,Dia可以生成对话音频,还可以生成非语言音效,如笑声,咳嗽,清嗓子等,还支持声音克隆。我基于当前Dia最新版本制作了免安装一键启动整合包。...

高精度2D图片转3D网格模型软件Stable3DGen整合包下载
本次和大家分享另一个非常牛叉的图片转3D模型软件Stable3DGen,从官方演示对比来看,效果要好于我之前分享的腾讯混元3D和TRELLIS,精度更高更细腻。基于当前最新版本我制作了一键启动整合包。 Stable3DGen介绍 随着从二维...

2D照片转3D视频软件stable-virtual-camera免安装一键启动整合包下载
本次和大家分享一个好玩实用的2D图片转3D视频软件stable-virtual-camera,支持多种相机模式,生成的3D视频效果丰富多样,适合多种使用场景,我基于当前最新版本制作了免安装一键启动整合包。 stable-virtual-ca...

AI歌曲创作软件DiffRhythm一键启动包,自定义风格AI谱曲演唱
DiffRhythm是首个基于扩散技术的开源音乐生成模型,能够创作完整的歌曲,包括AI谱曲,AI演唱。基于当前最新V1.2版本我制作了免安装一键启动整合包。 DiffRhythm介绍 Di♪♪Rhythm:速度惊人、简单至极、具有潜在扩散的...

虚拟试衣产品设计多图合成软件UNO一键启动整合包,人物转动漫工具
UNO是字节跳动开发的一款多主体图像生成软件,解决了角色或物体一致性的问题,可用于漫画、虚拟试衣等场景。我基于当前最新版本制作了免安装一键启动整合包。 UNO介绍 UNO是一款基于扩散模型的AI图像生成工具,核心目标是解决AI生成图像时难以...

临时邮箱,一次性匿名gmail.com邮箱
有时候网站需要测试一些功能,比如注册登录等,需要用到邮箱,但是自己的邮箱有限,不能更多的测试效果,这时候就需要一些不同后缀的一次性邮箱,网上有很多这样的一次性匿名邮箱,后缀很多,非常适合测试使用,下面分享几个比较好用的临时邮箱。 Gmail...

免费AI视频生成软件FramePack整合包下载,本地离线AI图片转视频工具
前段时间阿里开源了一个AI视频生成工具WAN2.1,可以实现文本转视频和图片转视频,虽说很强大,但是测试之后感觉软件对电脑配置要求太高了,感觉应该大部分用户都用不了,而且只支持720P视频,清晰度有些低,所以没和大家分享。前些天又出了一个更...

PDF OCR图片文字内容识别软件OCRmyPDF下载,免费PDF扫描内容转可搜索可复制工具
本次和大家分享一个非常热门强大的PDF文件内容OCR识别软件OCRmyPDF,这个软件可以将PDF内不可搜索的图片和文字识别转换为可复制可搜索的文本,并对PDF文件进行优化。 OCRmyPDF介绍 OCRmyPDF 为扫描的 PDF 文件添...

免费音效音乐生成软件AudioX整合包下载,快速音效配音工具
本次分享一个非常强大的音乐音效生成软件AudioX,这个软件可以通过提供文本、视频、图像、音乐和音频自动识别内容重新生成一段高质量的通用音频和音乐。 AudioX介绍 音频和音乐生成已成为众多应用中的关键任务,然而现有方法面临诸多限制:它们...