Midjourney 5.2震撼发布!原画生成3D场景,无限缩放无垠宇宙
亲爱的编程学习爱好者,如果你点开了这篇文章,说明你对《Midjourney 5.2震撼发布!原画生成3D场景,无限缩放无垠宇宙》很感兴趣。本篇文章就来给大家详细解析一下,主要介绍一下,希望所有认真读完的童鞋们,都有实质性的提高。
Midjourney和Stable Diffusion,已经卷到没边了!
几乎在Stable Diffusion XL 0.9发布的同一时间,Midjourney宣布推出了5.2版本。

此次5.2版本最亮眼的更新在于zoom out功能,它可以无限扩展原始图像,同时保持跟原始图像的细节相同。
用zoom out做出的无垠宇宙动画,直接让人震惊到失语,可以说,Midjourney 5.2看得比詹姆斯韦伯太空望远镜还要远!

这个极其强大的功能,可以创造出非常神奇的图片,甚至还能被用来拍摄毫无破绽的高清变焦视频!

这个「核弹级」更新,让网友直呼:你们这个功能也太强大了,直接把我的睡眠毁了!
玩了一个小时之后,这名网友再次表示:太强大了,我要哭了……


无限缩放,像宇宙一样没有尽头——

老奶奶宇宙中有多少个老奶奶?答案是无穷个——

爱丽丝追逐着小兔子不小心掉下了「兔子洞」,便进入了仙境。
而网友用zoom out自制的这个「兔子洞」,简直如梦如幻。

还有一个AI图像设计团队——ilumine AI只用一张很小的原画,就通过Zoom Out生成了下面这个宏大的场景图片。

然后再配合自家正在开发的技术2D转3D的技术,直接做了一个3D的游戏场景。


相信等到他们的产品正式推出之后,配合Midjourney Zoom Out这种凭空扩图的功能,用一张原画直接做出3D场景。
这简直是要革了游戏行业的命了,很多游戏制作从业者应该要哭出声吧。
Zoom Out誓要碾压Adobe AI和Uncrop?
此前,Adobe’s Generative Fill的填充功能,就被网友们玩疯了,它填充的周星驰电影剧照,可谓「毫无破绽」。

而Stability AI也紧接着放出大招。它联合Clipdrop推出了Uncrop Clipdrop——一个终极图像比例编辑器。

而Midjourney的V5.2的zoom out功能,也是不遑多让,甚至更加强大。
只要通过「/image」命令输入提示,Midjourney就会根据你的prompt生成四个视觉迭代图,你可以选择自己最喜欢的一个来放大,这个过程中,整个图像都会以更高的细节被渲染。
现在,所有Upscale的图像下方都有「Zoom Out」按钮,您可以使用它们来重新生成图像。
先给定一张需要缩放的原图,点击下面的「缩放两倍」的按钮。

和之前我们介绍过的Uncrop一样,Midjourney会生成4张备选的图案。
缩放之后4张备选图案的风格都非常一致,只是在背景的细节上有些差别。

在选择了4个Upscale的图案中的一个之后,还可以接着选择放大两倍对照片进行持续缩放。
可以看得出进一步缩放之后的图案风格和细节依然非常一致,如果你想持续缩放下去,就可以做出开头哈勃望远镜的效果。

你只要不停地重复这个过程,就能生成一张巨大无比的拥有无限多细节的「巨图」。
再配上热心网友的指导,就能生成文章一开头的「无限宇宙缩放动画」:

左图如梦似幻的仙境,还可以继续扩大,让艺术和梦幻的世界无限扩张……

网友们激动得觉也不睡了,直接玩疯了。
马斯克的霹雳宇宙是这样的。

这已经是大师级的艺术作品了。

墨菲斯变成绝地武士,场景扩大后,显得更厉害了。

有网友感慨道:Midjourney v5.2模拟从极近镜头到全开镜头的摄像机运动时,简直太赞了。
下一步是不是就是把速率变成每秒24-60帧,角色变成可移动的?12个月内是不是Midjourney就会有文字转视频服务了?

当然,还有紧跟时事的网友,为马老板做了八角笼对战图。

三大软件的无限缩放功能对比
Uncrop因为是免费软件,不知道是由于官方的处于节省资源的考虑还是技术上的问题,他们是不支持无限套娃缩放的。
原图:

缩放一次之后:

第二次缩放之后就会产生黑边,拒绝套娃。

而Midjourney的套娃宇宙我们在上边已经见识过它的效果了。
PS的GF,理论上只要画布能无限扩大,也可以吧一张图片在空白处无限补全,达成无限缩放的效果。
只是实现起来要比Midjourney麻烦一些。
硬核网友手把手教你怎么做猫头鹰视频
问题来了,文章开头那段震撼的猫头鹰飞行变焦视频,是怎么做出来的?
大师级网友「歸藏」给出了手把手教我们的详细教程。
首先,生成一张猫头鹰图,然后用下面的1.5倍Zoom Out按钮。

在连续重复这个过程7次之后,得到了7张视频的关键帧图像。
把他们排序之后,登陆app.cunwayml.com,在左边导航找到创建视频这个Tab,然后找到Frame Interpolation这个功能。

然后用我们做好的这7张图,拖进左边的位置上传,检查顺序无误后就可以点击Generate生成视频了。

一段时间之后就可以看到这段视频的预览效果,不过,普通用户只能导出720P。

太长不看版:V5.2更新的8大功能
简而言之,这次V5.2更新,可以概括为如下8大功能。
1 方形重构(Square Reframe)
-扩大图片大小
-选择制作方形
这次该更新附带的一个「制作正方形」工具,可以改变以正方形以外的纵横比制作图像的形状。

宽高比为16:9的原始图像

方形图像
使用这个工具,就可以调整任何照片的大小,重构图片,社交媒体上怎么方便展示,就怎么调整。

2 标准变焦(Standard Zoom 1.5 - 2x)
选择缩放1.5倍或2倍。
这个功能适合短距离变焦,可以为照片添加更多细节。

3 无限缩放「Endless Zoom (Re-Zoom a Pic) 」
这个功能可以围绕特定角色,为图片制作全新的大背景。

4 自定义缩放重构(Custom Zoom Reframing)
无论是艺术家、设计师还是品牌,都可以自定义图像大小,让图片适应任何在线平台。

5 风格化(Stylize)
Midjourney经过训练,可以创建具有艺术闪光和丰富视觉美感的图像,这是它与Stable Diffusion的最大区别。
以前,用户可以在提示的末尾添加「–styleize X」(图 X 的范围从 0-1000),但 V5.2采用了该模型现有的风格化功能,并在真实感和天赋方面将它们增加到11。



6 变化模式(Variation Mode)
Midjourney V5.2还附带了一个名为「变化模式」的新功能,可以用户反复打磨想要应用于输出的视觉细微差别。
在prompt中使用「低变化」模式,就能生成一致的角色形象,而如果选择「高变化」,就会导致与原始输出的较大的视觉差别,四张图片就会更加具有创意和艺术表现力。

7 不同的个人照片(Vary Individual Pics)
给它一张你的原始图片,你可以选择生成好四个类似的你,或者风格变化非常大的你。

8 更短提示(/Shorten Prompts)
关于Midjourney,人们往往有一个误解:如果在prompt中使用更多单词,就会看到更好或更详细的结果。
但其实,过于冗长的提示往往会抵消每个单词的影响,从而导致输出的图片并不一定符合用户的想法。
而这次Midjourney更新的缩短」命令功能,就可以分析prompt的成分,为我们提供了一些替代方案的建议。

通过全新的prompts,往往能让原始图片生成更惊艳的结果。

今天带大家了解了的相关知识,希望对你有所帮助;关于科技周边的技术知识我们会一点点深入介绍,欢迎大家关注golang学习网公众号,一起学习编程~
realme真我GT系列:续航能力与影像体验双提升
- 上一篇
- realme真我GT系列:续航能力与影像体验双提升
- 下一篇
- 如何提高Go语言开发中的代码可读性和可维护性
-
- 科技周边 · 人工智能 | 10小时前 | 人工智能 · 推理优化 ONNX Runtime 动态量化 nodes_to_exclude
- ONNX Runtime 动态量化怎么选择需要排除的节点
- 377浏览 收藏
-
- 科技周边 · 人工智能 | 12小时前 | 人工智能 · 向量检索 · Sentence Transformers truncate_dim 嵌入维度 Matryoshka 向量存储
- Sentence Transformers 怎么截断嵌入维度减少存储
- 165浏览 收藏
-
- 科技周边 · 人工智能 | 14小时前 |
- PEFT 多个 adapter 怎么按权重组合推理
- 454浏览 收藏
-
- 科技周边 · 人工智能 | 16小时前 |
- Accelerate 大模型推理怎么自动分配到多块设备
- 358浏览 收藏
-
- 科技周边 · 人工智能 | 18小时前 | 人工智能 · Tokenizers offset_mapping 原始文本
- Tokenizers offset mapping 怎么映射回原始文本位置
- 328浏览 收藏
-
- 科技周边 · 人工智能 | 21小时前 | python · 人工智能 · shuffle Hugging Face Datasets streaming IterableDataset buffer_size
- Datasets streaming 怎么在不下载全集时打乱样本
- 470浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 |
- Diffusers 单文件模型怎么转换成组件目录格式
- 308浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 | 人工智能 ·
- Diffusers 怎么临时禁用 LoRA 但保留已加载权重
- 309浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 | 人工智能 · diffusers ModularPipeline update_components ComponentSpec 模型组件
- Diffusers ModularPipeline 怎么替换单个模型组件
- 175浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 361次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 417次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 430次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 384次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 209次使用
-
- 本地大模型反复输出同一句话怎么调整生成参数
- 2026-09-06 501浏览
-
- Python 调用大模型时如何用结构化输出校验 JSON:从解析失败到可重试
- 2026-08-29 501浏览
-
- AI写作工具免费版安装教程(含豆包Clawdbot)
- 2026-05-30 501浏览
-
- WPS AI能自动生成PPT吗?输入主题一键制作演示文稿
- 2026-05-27 501浏览
-
- Canva手机闪退解决方法及适配指南
- 2026-05-25 501浏览

