Transcript of Holo 3.1 杀疯了!真正实现Token自由,AI 操控电脑,这才是最强本地Agent模型!附最新部署教程 | 零度解说
零度解说
0:00大家好 这里是零度解说0:02最近这两年 0:04AI Agent 越来越火0:06无论是 OpenAI 的 Operator0:08还是 Claude 的 Computer Use0:09都展现出让AI直接操作电脑的能力0:12但对普通用户来说0:14最大的问题其实只有一个0:16那就是太贵了0:17要么需要持续支付API费用0:19要么需要订阅会员0:20稍微用多一点成本就上来了0:22如果公司使用的话0:24要是不加限制0:25可能一夜一套房就没了0:26但就在最近0:28一家法国的AI公司0:29发布一个全新的Holo 3.1 Agent模型0:32这是一个专门面向Computer Use0:34也就是电脑操作场景打造的0:36AI Agent模型0:38相比传统大语言模型0:39它不仅能够理解屏幕内容0:42还能完成点击 输入0:43导航等实际操作任务0:45更重要的是0:46Holo 3.1支持本地部署0:48并且能够对接OpenClaw0:49或者是Hermes等主流的Agent框架0:52从而可以让AI真正获得0:53操作电脑的能力0:55只要你有一张消费级显卡0:57哪怕是4GB 8GB 0:5812GB0:59或者是24GB的1:00那么就意味着1:01你完全可以在自己电脑上1:03搭建一套本地的AI Agent1:05不用订阅会员1:06不用担心消耗Token1:08想跑多久就跑多久1:09那么Holo 3.1实际效果到底怎么样1:12对接OpenClaw之后1:13能不能像真人一样刷网页1:15整理资料 完成复杂任务呢1:17所以今天这期视频1:19我们就通过多个真实场景1:20来进全面测试1:21看看它的表现到底如何1:23接下来我们就进行本地部署1:25在开始之前1:26首先我们需要打开零度博客这篇文章1:28链接我会放在视频下方1:30好打开以后我们先往下拉1:32上面有我们接所需全部资料1:33首先第一步1:34我们需要下载最新版本的llama1:36cpp1:37这次我们同样通过llama1:37cpp进行部署1:39然后我们先点击前往打开它1:40好打开后我们看到1:41目前最新版本是B9601这个版本1:44就昨天更新的1:45那我们先打开它进行下载一下1:47目前它上方有不同版本1:48有这个macOS的1:50还有Windows版本1:51如果你是N卡的话1:52那么就下载这个CUDA版本1:54或者如果你是A卡的话1:55你就下载Vulkan版本1:57A卡的话就是HIP1:58因为我是N卡1:59所以我需要选择CUDA版本2:01我们给它download下来2:04好 下载好以后2:05那我们先把它解压出来2:06我们把它放到桌面上2:08然后先打开它2:10然后在根目录下创建一个文件夹2:11我们右键点击新建2:13创建一个新的文件夹2:15先把文件夹进行重命名一下2:16我们输入个models2:19一会儿用它来存放模型文件的2:21好重命名好以后先把它关闭掉2:23然后我们执行第二步2:24重新返回到刚刚帖子下2:25来下载这款开源模型2:27上方有模型集合下载2:28还有我打包好的不同尺寸的2:30GGUF格式的模型2:31然后我们先点击前往打开它2:33好打开后我们看到2:34上方有这个4B的模型2:36还有35B的 0.8B的 9B的2:39还有全量版的35B A3B2:41FP8精度的模型2:42但这里我需要说明一下的是2:44因为我们是通过这个llama2:45cpp来部署的2:46所以这里我们需要下载GGUF格式的模型2:49如果你需要下载9B模型的话2:50那么你需要重新返回到刚帖子下2:52来下载对应的9B模型2:54当然如果显存比较大的话2:55比如跟我一样是24GB显存的话2:57那么强烈建议选择这个A3B 35B模型3:00打开以后就下载一下3:01我们点第三个文件3:02好这时候我们看到3:04因为我选择是24GB的3:05所以我这里选择Q4_K_M版本3:07就是它量化版本3:08尺寸话是21GB左右3:10那我们先把它下载下来3:11点击下载3:13总共是19.83GB左右3:15我们点击下载3:19好下载好主模型以后3:20然后现在需要把视觉模型给down下来3:22就这个 MM开头的3:25总共是800多M3:27我们点击下载3:29同样给它下载下来3:30好下载好这两个模型以后3:32那我们现在需要把它放到指定文件夹下3:34现在我们打开刚解压出来的3:35llama3:36cpp文件夹3:37打开它3:38打开以后 这里面有个models文件夹3:40就刚创建的3:41好进入以后3:42然后现在把我们刚才下载好的模型3:43给它拖进来3:44就可以了3:46好拖入好以后3:47然后先重新返回到刚帖子下3:49来执行第三步3:50现在我们需要把这个3:51一键启动脚本给它拷贝出来3:54我们点击复制3:55好复制好以后3:56那我们先在桌面上3:57创建一个文本文档3:58我们鼠标右键点击这个创建4:01新建一个文本文档4:02好新建好以后我们打开它4:04然后先把我们刚复制出来的脚本4:05给它贴进来4:07点击粘贴4:08粘贴好以后 我们点上方一个另存为4:11保证编码选择UTF-84:13然后这个保证类型选择所有文件4:15再把这个文件名给重命名一下4:17我们输入这个启动4:18然后后面跟上后缀4:19bat4:20来创建一个批处理文件4:22输入好以后我们点击保存一下4:24好创建好以后4:25那将它放到这个llama4:26cpp4:27根目录下 给它放进来4:29好放好以后 我们先打开它4:31打开以后4:32然后在根目录下找到这个4:33启动4:33bat批处理4:34我们打开它4:37好打开以后我们看到4:38这里我提供了5种启动模式4:40到时候你可以根据自己显存4:41来去选择不同的模式4:42这里我选第四个4:44好输入好以后我们确认一下4:45好启动以后 那我们点允许4:48这个时候我们看到4:49它就会给我们提供一个本地访问链接4:51然后现在我们在浏览器打开地址来看一下4:53大家可以看一下4:54这样就可以了4:55它就会在右上角这里来显示模型了4:57加载模型以后4:58然后现在我们最小化窗口5:00不要关闭掉 给它最小化就可以了5:02然后现在我们执行第四步5:03就是安装OpenClaw5:04或者Hermes也是可以的5:06今天我们就拿这个OpenClaw来做演示5:08先把这个一键安装命令给拷贝出来5:10点击复制5:11好复制好以后5:12然后在下方搜索栏里5:13我们输入关键字PowerShell5:15找到以后5:16那我们现在需要以管理员身份来运行它5:18点击运行5:19好打开以后 那我们先鼠标右键粘贴一下5:21来安装一下最新版本的OpenClaw5:23当然如果你之前已经安装过的话5:24那么同样建议给它进行升级一下5:27那它需要安装一下Node5:28js5:28我们点允许5:31好它安装好以后5:32那我们先进配置一下5:33我们输入这个命令 OpenClaw onboard5:36来配置一下OpenClaw5:38那这里我们选择yes5:40配置模式选择quickstart5:42快速模式5:43然后这个配置文件5:44我建议全部重新设置5:46那这个服务提供商这里我们选择more5:48选择更多5:50然后在更多的模型这里5:51我们选择有一个自定义的选项5:53选好以后我们确认一下5:54然后这里面需要输入一个API地址5:56这个API地址就是我们之前部署5:57llama5:57cpp的访问地址5:59就是刚才这个6:00127.0.0.16:02然后后面跟上端口号12346:03那我们现在只要在后面添加这个6:05斜杠V1就行了6:06然后先把地址给拷贝出来6:09然后贴进来6:10贴到这个base URL地址这里6:12输入好以后我们确认一下6:13然后它让我们输入一个API key6:15我们确认一下6:16这个API key我们不用填写6:17因为我们是本地模型6:18留空就可以了 我们确认一下6:20然后它让我们选择多模态兼容性6:22这里我们选第一个就可以了6:23选择OpenAI的兼容模式6:24就选第一个就可以了6:25确认一下6:26然后它让我们输入模型ID6:28我们打开浏览器6:28来访问一下我们当前这个6:30加载的模型6:31到时候跟我一样6:32输入个地址6:32就是访问本地模型地址6:34打开可以看一下6:35好这里面看到6:36当前我的模型是Q4_K_M6:38GGUF6:39这就是我当前的模型名称6:41当然如果你下载的是不同的模型的话6:43那么你这个模型名称肯定是不一样的6:45到时候你直接复制自己的模型名称6:47就可以了6:48好复制好以后我们贴进来6:49贴到这个模型ID这里6:50粘贴进来以后我们确认一下6:52好这样的话它就载入成功了6:54接着我们确认一下6:55然后这里我们可以命名一下模型名称6:57比如说输入Holo 3.16:58这个你可以随便自定义7:00好输入好以后我们确认一下7:01然后这里它问我们是否支持图片输入7:03这里我们选择yes7:04好选择好以后确认一下7:06那这一步大家应该比较熟悉了7:07就是可以对接第三方的那个工具的7:09到时候可以对接Telegram7:10或者微信QQ等等都是可以的7:12这里我先不用对接7:13这里我先不对接 我确认一下7:15如果你需要的话7:16那么在后面可以自己进行对接7:18然后它让我们选择一下搜索服务提供商7:20这个我们可以不用管它7:21所以我们跳过就可以了7:22确认一下7:23然后这个安装skills7:25我们选择yes 确认一下7:26这里面是吧7:27到时候根据自己需要就选择就可以了7:28不需要的话就选跳过7:30通过空格键进行选择一下7:31我们跳过一下7:32然后这个Google API key7:33我们先不用 选no就可以了7:35是否开启Hocus 我们不用7:37跳过它7:37确认一下7:39然后重启一下这个网关7:40restart7:43然后通过哪种方式来访问Agent7:45第一个是在终端下7:46然后第二次在浏览器7:47我们就选浏览器打开它7:50好打开以后我们就看到7:51当前这个OpenClaw7:52就已经成功启动了7:53然后在下方这里我们选择模型7:55当前就是Holo 3.17:56就是我们刚才部署的本地模型7:58当前的off是代表它这个8:00关闭思考模式8:01因为作为Agent模型8:02没必要开启思考模式8:04否则话启动时间会很长8:05那我们先验证一下8:06看它能否回复8:07还是可以的8:08它说我已经上线了8:09你有什么需要帮助的吗8:11那我们现在来测试下效果8:12我们先来测试一下它的浏览器调用能力8:14比如我现在让它自动打开浏览器8:16访问零度博客的后台8:18然后自动登录账号密码8:20发布一篇博客文章8:21来看一下8:22它现在已经自己打开浏览器了8:24然后自己输入账号密码进行登录8:26登录后我们看一下8:27看它怎么操作的8:28我靠 它跟人一样8:30它会自己找到发布入口8:32然后填写标题8:33它标题写什么8:34说人工智能改变未来的技术8:37这是它自己写的8:38来看它怎么写文章内容的8:40好这个文章内容它也写进去了8:42它还像模像样自己点发布了8:43有哇8:45看看发布成功没有8:45我们看一下 在首页看一下8:47欸 确实发布了8:48它完全自动化的8:49大家可以看一下 没问题8:51这是它完全自己发布的8:52没有任何的人工干预8:54关键是它是完全本地模型来执行的8:56然后我们现在再测试一个8:58就让它自动打开谷歌来搜索9:00Claude Sondete GPT-4和Gemini 39:03分别进入它们官网9:04来整理价格 上下文长度9:06还有Agent能力 适用人群等等9:08最终生成对比表来看一下9:10它现在打开了9:11它已经打开第一个了9:12我靠它居然自动识别这个9:14浏览器上方有一个人工验证啊9:17这个是安全验证9:18它居然可以自己搞定啊9:20我靠这它怎么做到的9:21然后就搜索 阅读分析9:23最后给出来一个总结9:24没问题啊9:25它完全可以在浏览器自动化操作9:27我们再来测试一个9:29让它搜索RTX 60909:31相关的最新发布信息9:32并且总结主要内容9:33最后保存到桌面上9:34txt文件里9:36那我们点击发送一下9:37这个速度还是非常快的9:38刚开始我还担心会卡顿啊9:40它会自动打包压缩上下文9:42目前GPU使用率90%左右9:44它确实是在调用本地GPU9:45这个速度确实非常快啊9:47即使我当前用的是这个9:4835B A3B模型9:50跑本地Agent也依然非常流畅9:52这个确实是我没想到的9:53之前我还担心会不会非常卡呢9:56好这样的话它立马就完成了9:57它说已经把这个txt文档9:59保存我桌面上了10:00我们看一下有没有10:01进入我们桌面看一下10:02欸 真有啊 在这里面10:03大家可以看一下 都在里面10:05同时我让它搜索亚马逊上10:07这个RTX 509010:08价格低于2500美金10:10评分4.5以上10:11排名前三的这个商家10:12大家可以看一下10:13它也可以自动化搞定10:14帮我们整理出来10:15完全自动化10:16接下我们来测试一下10:17它获取资源的能力10:19比如让它打开地址10:20来将里面前2张图片10:21保存下载到桌面上10:23我们來看一下行不行10:24它现在已经开始了10:26它现在完成了10:26它说已经将的图片下载到桌面上了10:28我们看桌面有没有10:30额 大家可以看一下 在这里啊10:32立马搞定10:33都是高清图片 没问题啊10:36同时我们可以用它来分析图片10:37比如上传一张图片来试一下10:39就让它帮我找一下这张图片的10:41来处出处10:42大家可以看一下 它也搞定了10:43它就提供这个图片来源地址了10:45我们打开看一下 看行不行10:47看看能不能打开这个地址10:48没问题10:49更多好玩的到时候可以自己去尝试10:51好 今天视频所用的全部资料10:53它们的下载链接10:54我都放在视频下方还有零度博客上
494 words · 425 lines







