谷歌的人工智能文本到图像生成器Imagen 3上线
2024/08/16 06:04AI云资讯145494

(AI云资讯消息)据外媒报道,谷歌已向美国用户推出了其AI文本到图像生成器Imagen 3的最新版本。该工具可在谷歌的AI Test Kitchen中使用,据称其生成的图像比谷歌之前的模型具有更好的细节、更丰富的光线和更少的分散注意力的瑕疵。
谷歌于5月的I/O大会上首次宣布了其更新后的Imagen 3工具,但似乎只是在最近几天通过其Vertex AI平台将其作为通用工具提供。一些Reddit用户上周开始尝试使用Imagen 3,谷歌周二还发表了一篇关于该工具的研究论文。
与其他AI图像生成器一样,Imagen 3可以根据您的提示生成详细的图像。您还可以通过突出显示某个部分并描述想要更改的内容来编辑图像。

该工具似乎有一些限制,因为它不会生成公众人物或武器的图像。虽然它不会生成有明确版权的特定角色,但可以通过描述你想要创建的角色来轻松绕过这一限制。
尽管这些限制相对灵活,但Imagen 3仍然与马斯克的X平台上的AI图像生成器Grok形成了鲜明对比。Grok被用来生成各种疯狂的内容,包括含有毒品、暴力和公众人物做不端行为的图像。
但谷歌的AI工具也遇到了一些问题。今年早些时候,谷歌停止让人们使用Gemini AI聊天机器人生成图像,因为用户发现它生成的历史上不准确的图像。
相关文章
- 谷歌 AI 核心管理层迎来重大调整,负责人戴密斯·哈萨比斯卸任
- 谷歌 DeepMind 推出新一代 AI 模型,能够操控机器人的全身躯体
- 英伟达与微软牵头成立开放AI安全联盟,OpenAI、谷歌及Anthropic均未加入
- 谷歌携手联发科打造下一代TPUv9芯片,将CPU与计算晶粒合封于一体,助力AI智能体发展
- 谷歌投资A24,共同开发人工智能电影制作工具
- 数据中心耗电远超电网负荷,迫使英伟达与谷歌在2026年第三季度前启动800V直流电架构改造
- 苹果和谷歌新增对Thread 1.4的支持
- 宜选科技出席2026谷歌合作伙伴峰会
- 苹果在新版Siri上作出妥协:依靠英伟达B200 GPU加密技术,防止谷歌窃取用户数据
- 谷歌Beam抢滩多人会议全息赛道,微美全息以AI+5G解锁虚实融合视觉新想象
- Google I/O 2026亮点回顾:晶晨股份携手谷歌共拓端侧AI新生态
- 谷歌搜索的人工智能进化包含更多广告
- 谷歌的未来是一个无所不能的搜索框
- Google I/O 2026:Gemini 将成为谷歌年度开发者大会的主角
- 2026智能眼镜“百镜争鸣”,谷歌/阿里/微美全息引领AR/XR产业全面升级
- 谷歌发布 Chromebook 后继产品——Googlebook
AI企业
更多>>AI硬件
更多>>AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









