‌谷歌Veo-3手术视频生成AI被曝医学逻辑缺陷：视觉逼真但操作错误率超93%

Google • 2025年11月10日 13:15:00 • AI

最新研究显示，谷歌最新视频生成人工智能模型Veo-3在手术视频生成任务中表现两极分化：虽然能产出”清晰得令人震惊”的视觉画面，但对医学操作的理解存在严重缺陷。研究团队通过构建包含50段真实腹腔和脑部手术视频的SurgVeo评测标准，要求模型根据单张手术图像预测后续8秒进展，并由四位外科医生从视觉真实性、器械合理性、组织反应及手术逻辑性四个维度评分。

结果显示，在腹腔手术测试中，Veo-3的视觉合理性获得3.72分（满分5分），但器械操作仅1.78分，组织反应1.64分，手术逻辑性更是低至1.61分。神经外科场景中，其8秒后手术逻辑性得分仅为1.13分。深入分析发现，93%的错误源于医学逻辑层面，包括虚构手术器械、违反生理规律的组织反应等。即便提供手术类型和操作阶段等上下文信息，模型表现仍未见显著改善。

研究团队指出，当前视频生成AI与真正理解医学操作仍有巨大差距。虽然未来可能应用于医生培训和术前规划，但现有模型存在误导风险，可能传播错误手术技巧。为推进研究，团队计划开源SurgVeo数据集，同时警告医学界需谨慎使用此类生成内容。该研究揭示了AI在专业领域应用的局限性——视觉表现力不等于专业认知能力。

原创文章，作者：Google，如若转载，请注明出处：https://www.kejixun.co/article/738160.html

AI Veo-3 谷歌

Google认证作者

0 0

新闻

美政府施压Meta提交AI模型接受安全审查

据《纽约时报》援引知情人士消息，美国政府正加紧向Meta公司施压，要求其主动提交人工智能模型供政府审查，以便评估这些前沿技术的功能表现与潜在安全漏洞。这一举措是美国政府强化AI监管…

好奇宝宝
21小时前
AI

京东开源实时视频交互模型，让AI从“一问一答”走向“边看边说”

京东近日正式开源了实时视频视觉语言交互模型JoyAI-VL-Interaction，这是全球首个全栈开源的交互式视觉模型与可部署系统，并获得vLLM-Omni的day-0原生支持。…

小科同学
1天前
AI

Meta暂停监控员工键盘鼠标的AI项目，因数据泄露致内部敏感信息外泄

据Business Insider报道，Meta公司已紧急叫停一项名为“模型能力计划（MCI）”的AI训练项目，该项目原本用于记录公司内部员工的键盘敲击和鼠标操作轨迹，以收集训练数…

李小白
1天前
AI

亚马逊在ChatGPT打广告引流，却严防AI爬虫抓取自家数据

美国电商巨头亚马逊近日被曝已开始在ChatGPT平台投放广告，成为入驻OpenAI新兴广告业务中最具分量的零售企业。用户在使用ChatGPT搜索商品时，对话列表下方会直接出现亚马逊…

李森
1天前
AI

Getty Images牵手OpenAI：图库内容将融入ChatGPT搜索体验

全球视觉内容巨头Getty Images日前宣布与OpenAI达成一项展示合作协议，标志着AI对话工具与正版视觉素材的融合再进一步。根据协议，Getty Images获得授权的海量…

AI
2天前
新闻

微软将移除 Edge 浏览器文件互传功能 Drop，重心转向 Copilot

6月22日，微软证实，在 Edge 149 版本取消侧边栏和集锦功能支持后，将移除浏览器内广受好评的文件互传功能 Drop。微软正在砍掉 Edge 绝大多数独家特色功能，把重心全面…

潮玩君
2天前
AI

纽约大学教授警告：AI泡沫破裂后果或超互联网泡沫

据外媒昨日报道，纽约大学金融学教授阿斯沃斯·达摩达兰发出严厉警告，称若当前AI行业泡沫破裂，其冲击可能比2000年前后的互联网泡沫更为严重。达摩达兰指出，AI热潮与当年互联网泡沫存…

泡沫大盗
3天前
AI

谷歌Gemini联席负责人诺姆·沙泽尔离职加入OpenAI

当地时间6月18日，谷歌前工程副总裁、Gemini技术联席负责人诺姆·沙泽尔在社交媒体X上宣布离职，并将加入OpenAI。沙泽尔表示，离开谷歌是一个艰难决定，他为谷歌团队及共同取得…

Google
3天前
AI

微信原生AI助手“小微”扩大灰度测试，一句话即可生成小程序

近日，微信原生AI助手“小微”开始扩大灰度测试范围，多个平台上陆续有用户反馈获得了体验资格。腾讯客服确认，“小微”目前仍处于测试阶段，支持通过文字或语音对话操作微信原生功能，例如调…

AI
3天前
新闻

亚马逊工程师因公开批评AI数据中心扩张遭内部调查

美国CNBC当地时间18日报道，多名亚马逊工程师因在公开场合批评公司AI数据中心迅速扩张并呼吁政府加强监管，随后遭到亚马逊内部调查，甚至面临解雇风险。本月早些时候，5名亚马逊员工在…

若安丶
4天前
AI

黄仁勋呼吁社会全面拥抱AI，类比汽车适应时代

当地时间6月17日，英伟达CEO黄仁勋在接受美联社采访时再度为人工智能热情发声，他呼吁社会必须主动改变，更积极、更广泛地拥抱AI，以改善人们的生活并加速经济增长与科学突破。面对AI…

若安丶
5天前
新闻

谷歌推送Android 17正式版深度集成AI模型迎战苹果

谷歌于当地时间周二正式推送了Android 17正式版，同时发布智能手表操作系统Wear OS 7，新版系统率先搭载于Pixel系列设备并同步上线专属功能更新包，新增对音乐生成模型…

Android
2026年6月17日
AI

OpenRouter推出Fusion API复合模型服务多模型协同兼顾性能与成本

近日，知名AI模型聚合平台OpenRouter推出一项名为Fusion API的复合型模型服务，通过多模型协同的方式为用户提供兼具性能表现与成本效益的解决方案。该服务并非依赖单一模…

小丸子
2026年6月17日
商业

DeepSeek完成逾70亿美元融资创始人梁文锋以特殊架构保持绝对控制权

据国外媒体报道，AI大模型独角兽DeepSeek（深度求索）日前以非常规交易架构顺利完成首轮逾70亿美元（约合500亿元人民币）融资，投后估值突破500亿美元大关。本轮融资的最大创…

商业头条
2026年6月17日
AI

豆包上线“任务模式”，从聊天助手向AI智能体进化

字节跳动旗下AI对话助手豆包近日正式推出“任务模式”入口，标志着这款产品正从单一的文本交互工具向具备复杂工作流处理能力的AI智能体演进。作为豆包功能拓展的重要一步，“任务模式”主打…

AI
2026年6月16日
AI

苹果或推AI智能体让Siri自主操作用户设备，古尔曼预测对标“OpenClaw”

彭博社知名记者马克·古尔曼近日预测，苹果公司最终可能推出一套能够代用户自主操作各类软件的智能体AI系统，直接对标业界关注的“OpenClaw”项目。古尔曼在其专栏《Power On…

Apple
2026年6月16日
AI

讯飞医疗发布星火大模型V3.5，AI医疗赛道迎来实用化转折

AI医疗行业的竞争逻辑正发生深刻变化。6月9日，讯飞医疗正式发布基于全国产算力底座训练的星火医疗大模型V3.5。与以往单纯追求参数规模的行业风向不同，这款新模型将目光锁定在临床诊疗…

AI
2026年6月15日
AI

高盛研报：市场低估AI需求，资本支出将远超预期

知名投行高盛近日发布行业研报指出，当前市场普遍低估了人工智能领域的发展需求，超大规模数据中心运营商的AI相关资本支出将大幅超出行业预期。数据显示，华尔街目前预估2027年相关资本支…

秋秋
2026年6月15日
新闻

谷歌CEO皮查伊斯坦福毕业演讲避谈AI，鼓励毕业生“选择乐观”

当地时间周日，谷歌首席执行官桑达尔·皮查伊在斯坦福大学毕业典礼上发表演讲。与近期其他科技领袖的毕业致辞不同，皮查伊对人工智能几乎只字未提，而是转而鼓励毕业生“选择乐观”。这一回避…

Google
2026年6月15日
新闻

Android安全负责人辞职，控诉谷歌“丧失道德底线”

据Business Insider周四报道，谷歌Android平台安全负责人、高级工程师René Mayrhofer已从公司离职。他在一封落款5月18日的内部告别信中直言，谷歌管理…

Android
2026年6月14日

发表回复

登录后才能评论

‌谷歌Veo-3手术视频生成AI被曝医学逻辑缺陷：视觉逼真但操作错误率超93%

相关推荐

发表回复