谷歌将计算机使用工具直接集成至Gemini，AI从对话者进化为数字同事

Google • 2小时前 • AI

谷歌昨日对其人工智能生态系统进行重大升级，正式将原生的“计算机使用”工具直接集成至Gemini 3.5 Flash模型中，全面取代此前的Gemini 2.5测试框架。这一举措标志着人工智能正从单纯的“对话者”加速演变为具备实际执行能力的“数字同事”，推动AI代理从概念走向落地。

通过Gemini API，开发者现可利用该模型的原生能力构建智能代理，这些代理不再依赖复杂的底层代码编写，而是像人类用户一样，通过感知和理解屏幕截图等视觉信息直观地导航应用程序，进而自动执行各种复杂桌面任务。这在办公自动化、软件测试及跨平台数据处理等场景中展现出巨大潜能，包括自动化浏览网站、填写长表单、点击界面按钮，以及高效处理桌面、移动和浏览器环境中的重复性数据收集工作。

为加速生态构建，谷歌已在Browserbase上开设实时演示空间，供开发者立即测试相关功能。面对赋予AI鼠标和键盘控制权所带来的安全挑战，如间接指令注入风险，谷歌强调已采取对抗训练来增强模型防御能力，同时推出两款企业级安全系统——允许企业设置软件，要求AI在执行敏感操作前获得人工批准，以及在检测到潜在攻击时自动冻结任务，多维度保障用户桌面安全。配合模型升级，谷歌同日发布Chrome 149稳定版，引入“从屏幕中选择”功能，用户可通过拖拽框选当前标签页中的图像或文本，瞬间将其添加为Gemini的提示语。

谷歌此次将原生工具集成至Gemini，不仅深化了AI与操作系统的结合，也预示着行业正从追求大模型参数规模转向实际的任务执行能力。

原创文章，作者：Google，如若转载，请注明出处：https://www.kejixun.co/article/756128.html

Google认证作者

0 0

新闻

美政府施压Meta提交AI模型接受安全审查

据《纽约时报》援引知情人士消息，美国政府正加紧向Meta公司施压，要求其主动提交人工智能模型供政府审查，以便评估这些前沿技术的功能表现与潜在安全漏洞。这一举措是美国政府强化AI监管…

好奇宝宝
2天前
AI

京东开源实时视频交互模型，让AI从“一问一答”走向“边看边说”

京东近日正式开源了实时视频视觉语言交互模型JoyAI-VL-Interaction，这是全球首个全栈开源的交互式视觉模型与可部署系统，并获得vLLM-Omni的day-0原生支持。…

小科同学
3天前
AI

Meta暂停监控员工键盘鼠标的AI项目，因数据泄露致内部敏感信息外泄

据Business Insider报道，Meta公司已紧急叫停一项名为“模型能力计划（MCI）”的AI训练项目，该项目原本用于记录公司内部员工的键盘敲击和鼠标操作轨迹，以收集训练数…

李小白
3天前
AI

亚马逊在ChatGPT打广告引流，却严防AI爬虫抓取自家数据

美国电商巨头亚马逊近日被曝已开始在ChatGPT平台投放广告，成为入驻OpenAI新兴广告业务中最具分量的零售企业。用户在使用ChatGPT搜索商品时，对话列表下方会直接出现亚马逊…

李森
3天前
AI

Getty Images牵手OpenAI：图库内容将融入ChatGPT搜索体验

全球视觉内容巨头Getty Images日前宣布与OpenAI达成一项展示合作协议，标志着AI对话工具与正版视觉素材的融合再进一步。根据协议，Getty Images获得授权的海量…

AI
4天前
新闻

微软将移除 Edge 浏览器文件互传功能 Drop，重心转向 Copilot

6月22日，微软证实，在 Edge 149 版本取消侧边栏和集锦功能支持后，将移除浏览器内广受好评的文件互传功能 Drop。微软正在砍掉 Edge 绝大多数独家特色功能，把重心全面…

潮玩君
4天前
AI

纽约大学教授警告：AI泡沫破裂后果或超互联网泡沫

据外媒昨日报道，纽约大学金融学教授阿斯沃斯·达摩达兰发出严厉警告，称若当前AI行业泡沫破裂，其冲击可能比2000年前后的互联网泡沫更为严重。达摩达兰指出，AI热潮与当年互联网泡沫存…

泡沫大盗
5天前
AI

谷歌Gemini联席负责人诺姆·沙泽尔离职加入OpenAI

当地时间6月18日，谷歌前工程副总裁、Gemini技术联席负责人诺姆·沙泽尔在社交媒体X上宣布离职，并将加入OpenAI。沙泽尔表示，离开谷歌是一个艰难决定，他为谷歌团队及共同取得…

Google
5天前
AI

微信原生AI助手“小微”扩大灰度测试，一句话即可生成小程序

近日，微信原生AI助手“小微”开始扩大灰度测试范围，多个平台上陆续有用户反馈获得了体验资格。腾讯客服确认，“小微”目前仍处于测试阶段，支持通过文字或语音对话操作微信原生功能，例如调…

AI
5天前
新闻

亚马逊工程师因公开批评AI数据中心扩张遭内部调查

美国CNBC当地时间18日报道，多名亚马逊工程师因在公开场合批评公司AI数据中心迅速扩张并呼吁政府加强监管，随后遭到亚马逊内部调查，甚至面临解雇风险。本月早些时候，5名亚马逊员工在…

若安丶
6天前
AI

黄仁勋呼吁社会全面拥抱AI，类比汽车适应时代

当地时间6月17日，英伟达CEO黄仁勋在接受美联社采访时再度为人工智能热情发声，他呼吁社会必须主动改变，更积极、更广泛地拥抱AI，以改善人们的生活并加速经济增长与科学突破。面对AI…

若安丶
2026年6月19日
新闻

谷歌推送Android 17正式版深度集成AI模型迎战苹果

谷歌于当地时间周二正式推送了Android 17正式版，同时发布智能手表操作系统Wear OS 7，新版系统率先搭载于Pixel系列设备并同步上线专属功能更新包，新增对音乐生成模型…

Android
2026年6月17日
AI

OpenRouter推出Fusion API复合模型服务多模型协同兼顾性能与成本

近日，知名AI模型聚合平台OpenRouter推出一项名为Fusion API的复合型模型服务，通过多模型协同的方式为用户提供兼具性能表现与成本效益的解决方案。该服务并非依赖单一模…

小丸子
2026年6月17日
商业

DeepSeek完成逾70亿美元融资创始人梁文锋以特殊架构保持绝对控制权

据国外媒体报道，AI大模型独角兽DeepSeek（深度求索）日前以非常规交易架构顺利完成首轮逾70亿美元（约合500亿元人民币）融资，投后估值突破500亿美元大关。本轮融资的最大创…

商业头条
2026年6月17日
AI

豆包上线“任务模式”，从聊天助手向AI智能体进化

字节跳动旗下AI对话助手豆包近日正式推出“任务模式”入口，标志着这款产品正从单一的文本交互工具向具备复杂工作流处理能力的AI智能体演进。作为豆包功能拓展的重要一步，“任务模式”主打…

AI
2026年6月16日
AI

苹果或推AI智能体让Siri自主操作用户设备，古尔曼预测对标“OpenClaw”

彭博社知名记者马克·古尔曼近日预测，苹果公司最终可能推出一套能够代用户自主操作各类软件的智能体AI系统，直接对标业界关注的“OpenClaw”项目。古尔曼在其专栏《Power On…

Apple
2026年6月16日
AI

讯飞医疗发布星火大模型V3.5，AI医疗赛道迎来实用化转折

AI医疗行业的竞争逻辑正发生深刻变化。6月9日，讯飞医疗正式发布基于全国产算力底座训练的星火医疗大模型V3.5。与以往单纯追求参数规模的行业风向不同，这款新模型将目光锁定在临床诊疗…

AI
2026年6月15日
AI

高盛研报：市场低估AI需求，资本支出将远超预期

知名投行高盛近日发布行业研报指出，当前市场普遍低估了人工智能领域的发展需求，超大规模数据中心运营商的AI相关资本支出将大幅超出行业预期。数据显示，华尔街目前预估2027年相关资本支…

秋秋
2026年6月15日
新闻

谷歌CEO皮查伊斯坦福毕业演讲避谈AI，鼓励毕业生“选择乐观”

当地时间周日，谷歌首席执行官桑达尔·皮查伊在斯坦福大学毕业典礼上发表演讲。与近期其他科技领袖的毕业致辞不同，皮查伊对人工智能几乎只字未提，而是转而鼓励毕业生“选择乐观”。这一回避…

Google
2026年6月15日
新闻

Android安全负责人辞职，控诉谷歌“丧失道德底线”

据Business Insider周四报道，谷歌Android平台安全负责人、高级工程师René Mayrhofer已从公司离职。他在一封落款5月18日的内部告别信中直言，谷歌管理…

Android
2026年6月14日

发表回复

登录后才能评论

谷歌将计算机使用工具直接集成至Gemini，AI从对话者进化为数字同事

相关推荐

发表回复