网站首页 > 精选文章 正文
IT之家 10 月 27 日消息,据 The Information 报道,谷歌计划在 12 月预览其大型动作模型“Project Jarvis”。知情人士透露,该项目将帮助用户执行诸如“收集研究、购买产品或预订航班”等任务。
报道称,“Jarvis”将由未来版本的谷歌 Gemini 驱动,专门针对 Chrome 浏览器进行优化。该工具旨在通过截取屏幕截图、解析内容并自动点击按钮或输入文本,帮助用户“自动化日常的网页任务”。目前,该工具在执行不同操作的时候,中间会有几秒钟的间隔时间。
IT之家注意到,目前所有大型 AI 公司都在研发类似功能的模型。微软的 Copilot Vision 可以与用户讨论正在浏览的网页;苹果的 Apple Intelligence 预计将在明年具备跨多个应用程序的屏幕识别能力;Anthropic 刚刚推出的 Claude 测试版已能在计算机上执行操作;OpenAI 也在研发类似的功能。
报道称,谷歌展示“Jarvis”的计划也可能会有所变动,预计将首先向少量测试者发布,以帮助公司修复潜在的 Bug。
猜你喜欢
- 2024-12-16 Chaos 工具详解:快速获取目标网站子域名信息
- 2024-12-16 Microsoft Teams迎来Project与Roadmap功能集成
- 2024-12-16 微软推出新版Planner应用:整合To Do和经典Planner功能
- 2024-12-16 Project Centennial:微软发布新款“桌面应用转换器”工具
- 2024-12-16 ProjectWise 中依存关系查看器不可见,是怎么回事?
- 2024-12-16 Google 发布基于 VSCode 的全新人工智能代码编辑器 Project IDX
- 2024-12-16 Android端Project xCloud新功能:观看预热视频时加载游戏
- 2024-12-16 JIRA使用教程:查看项目
- 最近发表
- 标签列表
-
- 向日葵无法连接服务器 (32)
- git.exe (33)
- vscode更新 (34)
- dev c (33)
- git ignore命令 (32)
- gitlab提交代码步骤 (37)
- java update (36)
- vue debug (34)
- vue blur (32)
- vscode导入vue项目 (33)
- vue chart (32)
- vue cms (32)
- 大雅数据库 (34)
- 技术迭代 (37)
- 同一局域网 (33)
- github拒绝连接 (33)
- vscode php插件 (32)
- vue注释快捷键 (32)
- linux ssr (33)
- 微端服务器 (35)
- 导航猫 (32)
- 获取当前时间年月日 (33)
- stp软件 (33)
- http下载文件 (33)
- linux bt下载 (33)