最新最快科技资讯
太阳能光伏网

搜索

CapCut与谷歌Gemini达成合作,将集成视频图像编辑功能

2026年5月21日,剪映国际版CapCut在X平台宣布与谷歌Gemini展开合作。用户未来可在Gemini应用内直接调用CapCut的创意与视频图像编辑功能。双方未披露具体上线时间及技术细节。此举旨在推动创作流程更对话化、直观化与跨工具智能集成。据悉,这并非首次合作--去年已有测试显示CapCut支持导入并编辑Google...

谷歌I/O发布Workspace语音助手与Pics图像编辑工具

2026年5月20日,谷歌在I/O开发者大会宣布升级Google Workspace,推出Gmail Live、Docs Live和Keep语音协作功能。用户可通过自然语音检索邮件、口述生成文档并自动整合Drive及聊天资料、口头记录并智能整理笔记。同期发布独立图像应用Google Pics,基于Nano Banana模型,支持高精度局部编辑、对象替换与风...

DuckDuckGo上线免费AI图像编辑功能

2026年2月19日,美国隐私搜索引擎DuckDuckGo在其AI平台Duck.ai正式推出AI图像编辑功能。该功能无需注册、免费使用(设用量限额),支持JPEG、PNG、WebP等格式图片上传。用户通过文字指令(如"移除水杯""替换背景")即可触发编辑,后端调用OpenAI模型处理。为保障隐私,系统自动剥离图片元数据及IP地址,原始图...

谷歌Chrome上线Gemini AI侧边栏,支持网页自动浏览与图像编辑

2026年1月29日,谷歌正式更新Chrome浏览器,推出基于Gemini的AI侧边栏功能。该功能面向MacOS、Windows及Chromebook Plus用户免费开放,支持多标签页并行任务处理。用户点击顶部Gemini图标即可调用AI,执行搜索、跨谷歌服务(如Gmail、地图、YouTube等)操作,并直接编辑网页内图像(集成Nano Banana模型)。自...

通义千问图像编辑模型Qwen-Image-Edit推出新版本

12月25日,阿里云通义千问宣布图像编辑模型Qwen-Image-Edit-2511正式开源。据介绍,该模型2509版本存在图像编辑后的轻微漂移,也即编辑前后的人物或物体有轻微的移动,其在2511版本中着重进行了包括一致性提升在内的多项增强。

阿里通义推出全新图像编辑模型Qwen-Image-Edit-2511

2025年12月23日,阿里通义Qwen团队发布全新图像编辑模型Qwen-Image-Edit-2511。该模型在前代基础上优化了图像漂移、人物一致性和几何推理能力,并集成LoRA功能,提升工业设计生成表现。专为图像编辑场景打造,支持通过自然语言指令实现精准修改,如"替换画面中的猫为狗"或"移除背景路人",无需专业图像软件...

苹果发布40万图像数据集Pico-Banana-400K,推动文本引导图像编辑研究

苹果公司近日推出Pico-Banana-400K,一个包含40万张图像的大规模数据集,旨在促进文本引导图像编辑技术的发展。该数据集基于谷歌Gemini-2.5模型构建,涵盖多样化的编辑指令与真实场景图像,并通过Nanon-Banana模型生成、Gemini 2.5-Pro模型验证,确保高质量与指令一致性。数据集包含单轮与多轮编辑序列及...

微软测试新版画图AI功能:一键生成动画与图像编辑

科技媒体Windows Latest报道,微软正通过Windows AI实验室项目,为Windows 11新版画图应用测试两项突破性AI功能。目前受邀用户无需加入Windows预览体验计划即可申请体验资格。首项"AI动画生成"功能可将静态图片一键转化为动态GIF,处理耗时约40-60秒,用户通过Copilot侧边栏的Animate按钮即可操作。第二...

谷歌Nano Banana模型本月登陆Photoshop,AI图像编辑迎来革新

Adobe首席设计推广大使Howard Pinsky日前宣布,谷歌Nano Banana模型将于本月内正式集成至Photoshop。用户届时可结合提示词编辑功能与Photoshop选区、图层及蒙版等非破坏性工具,实现更智能的图像处理。自谷歌推出Gemini 2.5 Flash Image集成以来,其AI图像编辑功能已完成超2亿次操作,并吸引超千万新用户...

谷歌Nano Banana引爆AI图像编辑热潮,Gemini新功能单日处理超2亿次操作

谷歌AI实验项目"Nano Banana"近日迅速走红,其集成的Gemini 2.5 Flash图像编辑功能上线后单日处理超过2亿次操作,吸引超1000万新用户体验。实验室副总裁Josh Woodward透露,高并发请求导致系统负载激增。该技术凭借优异的人物特征一致性表现脱颖而出,有效避免了面部失真和恐怖谷效应,在多次修改中仍能维...

谷歌DeepMind发布Gemini 2.5 Flash图像编辑模型 提升图文编辑精准度

谷歌DeepMind近日推出全新Gemini 2.5 Flash图像编辑模型,该模型在Gemini应用中可根据文字指令,更精准地修改图片,尤其在人物与动物外观一致性保持方面表现突出。相比此前图像生成工具,其图文修改准确率更高,在多项任务中优于GPT-4o。新模型支持"角色一致性"功能,可在多张生成图像中维持同一对象的外观...

通义千问推出图像编辑模型Qwen-Image-Edit

2025年8月19日,阿里通义千问发布全新图像编辑模型Qwen-Image-Edit。该模型基于此前发布的20B参数Qwen-Image模型进一步训练,将文本渲染能力拓展至图像编辑领域,可实现对图片中文字的精准修改和处理,进一步提升图像内容生成与调整的灵活性。免责声明: 本文内容由开放的智能模型自动生成,仅供参考。

通义千问推出Qwen-Image-Edit 实现语义与外观双重图像编辑

通义千问今日发布Qwen-Image-Edit,基于20B模型Qwen-Image升级而来,拓展了图像编辑能力。该模型融合Qwen2.5-VL与VAE Encoder技术,实现对图像语义和外观的双重精准控制。用户可在Qwen Chat平台体验"图像编辑"功能。Qwen-Image-Edit支持中英文文字修改、IP创作、风格迁移、视角转换、元素增删等多样化操...

火山引擎发布豆包系列模型3.0,图像编辑与同声传译能力全面升级

在 FORCE Link AI 创新巡展・厦门站上,火山引擎推出豆包・图像编辑模型3.0与豆包・同声传译模型2.0等多项升级产品。豆包图像编辑模型具备更强的指令理解与高清图像处理能力,支持自然语言操作,可实现图像风格转换、细节修改、内容消除等多样化编辑功能,适用于影像创作、广告营销等多个场景。同声传译...

苹果Pixelmator Pro更新 加入AI创作与图像编辑新功能

科技媒体MacRumors报道,苹果近期为其图像编辑应用Pixelmator Pro推出3.7版本更新,新增支持Apple智能功能,包括AI驱动的"写作工具"和"图乐园"。用户可通过"图乐园"快速生成原创图像,或利用AI优化现有作品风格;"写作工具"则整合了文本校对、总结及ChatGPT辅助创作功能,提升设计效率。此次更新还优化了R...

字节发布SeedEdit3.0图像编辑模型 支持处理和生成4K图像

[太平洋科技快讯]近日,字节跳动旗下的Seed团队正式推出了其图像编辑模型的最新版本――SeedEdit 3.0。目前已在即梦网页端开启测试,其移动端应用豆包App也即将同步上线。在图像编辑领域,利用AI根据指令进行编辑的需求广泛存在,但以往的技术在保持主体与背景的协调性、精准遵循用户指令等方面能力有限,...

字节跳动发布图像编辑模型SeedEdit 3.0

6月6日,字节跳动Seed团队推出SeedEdit 3.0模型,可生成4K图像,精细处理编辑区域并高保真保留其他信息。未来将优化性能,并探索多图生成、图像合成及故事性内容生成等新功能。免责声明: 本文内容由开放的智能模型自动生成,仅供参考。

谷歌 Gemini 新增本地图像编辑功能,支持多步骤个性化定制

谷歌在最新博客中宣布,Gemini 聊天机器人应用现已支持修改由 AI 生成的图像及用户上传的图片。这一本地图像编辑功能将逐步在全球范围内推出,未来几周内覆盖多数国家,并支持超 45 种语言。新功能基于谷歌此前在 AI Studio 平台测试的图像编辑模型,具备删除水印等能力,同时提供类似 ChatGPT 图像工具的...

阶跃星辰发布图像编辑模型 Step1X-Edit,性能开源最佳

今日,阶跃星辰发布通用图像编辑模型 Step1X-Edit ,提供人人可用的多模态改图能力,可以帮用户完成日常工作和生活中最高频的 11 类图像编辑任务: 包括替换图片中的文字、为人物做美化修图、对画面进行风格迁移和材质变换等。用户在阶跃 AI App 和网页端(stepfun.com)可以免费使用。网友评价,这款改图工...

阶跃星辰开源图像编辑大模型Step1X-Edit,性能达开源SOTA

阶跃星辰今日宣布开源图像编辑大模型Step1X-Edit,其性能达到开源领域先进水平。该模型总参数量为19B,结合7B多模态大语言模型(MLLM)和12B扩散变换模型(DiT),具备语义精准解析、身份一致性保持及高精度区域级控制三项核心能力,可支持文字替换、风格迁移、材质变换等11类高频图像编辑任务。Step1X-Edit...