智能体

制作包含音效、人物形象一致、场景精美的成品视频。无需剪辑。

试试Pollo Agent
复刻爆款视频

几分钟内即可重新混音热门视频。

复刻视频广告

克隆成功的电商广告。

UGC 视频广告

制作逼真的UGC视频广告。

动漫视频

将剧本改编成动画视频。

URL 转视频广告

将网址转换成精美的视频广告。

故事视频

将话题转化为电影故事。

音乐视频

将歌曲制作成音乐视频。

新闻视频

几分钟内即可制作出广播新闻。

解说视频

将文本转化为引人入胜的解释性文章。

首页/博客/评论/Midjourney 评测:我花了 14 天测试它的图像和视频功能,以下是我的发现

Midjourney 评测:我花了 14 天测试它的图像和视频功能,以下是我的发现

我花了两个星期的时间,在真实场景中测试了 Midjourney AI 也就是设计师、营销人员和内容创作者实际工作中的那些场景。我测试了五大类图像生成,以及三种不同内容类型的视频生成。没有刻意挑选,也没有使用 Photoshop 等后期处理,只有原始输出结果,并坦诚地分享哪些有效,哪些无效。以下是我的发现。

TL;DR:Midjourney AI 值得使用吗?

值得使用,如果:你需要艺术性强、电影质感、画廊级别的图片。你从事概念设计、社交媒体图片、情绪板制作或奇幻艺术创作。速度和美感比精确度更重要。

不值得使用,如果:您需要照片级真实的产品图、图中清晰可读的文字、精准的元素摆放,或希望进行自由探索;您还需要通过 API 实现自动化工作流

最适合:重视艺术冲击力而非技术精确性的设计师、概念艺术家、创意总监、营销人员、插画师。

指标

等级

笔记

图像质量(艺术性)10/10一流的电影和奇幻作品
图像质量(真实感)6.5/10产品和照片级真实感方面的挑战
视频生成7.5/10非常适合拍摄风景,但不太擅长拍摄人物
文本渲染4/10成功率低于 10%
易用性9/10基于 Discord 的直观工作流程
速度8.5/10使用草稿模式快速迭代
自定义与控制6/10对提示词理解良好,但精确控制能力有限
总分8.5/10艺术作品的黄金标准,要了解它的局限性

我如何测试 Midjourney

我使用 AI 图像生成器对五类图像和三段视频进行了结构化测试。每项测试都包含多个提示,难度从简单到刻意复杂不等。所有输出结果均为全新生成,未经过任何后期处理或编辑。我从四个方面评估每个结果:提示词一致性、输出可用性、重复生成结果的一致性以及实际应用性。

我没有刻意挑选结果。这篇评测中的每一张图片和视频都代表了我的真实体验——包括成功和失败的案例。

Midjourney 的 AI 图像生成测试

测试 1:电影感人像摄影

人像拍摄是模型展现自身实力或惨遭失败的舞台。我测试了三种情感各异的场景,这些场景既需要技术上的精准,也需要艺术上的细腻。我的目标是检验 Midjourney 能否超越千篇一律的美颜照,真正捕捉到人物的情绪。

提示词

图像输出

一张特写肖像,一位男士坐在灯光昏暗的爵士酒吧里,若有所思地望着远方。温暖的琥珀色光线勾勒出他的下颌线条。胶片颗粒感,浅景深,徕卡美学风格。柔和温暖的灯光照亮了一位侧脸男子。

效果惊艳。琥珀色的光线环绕着他的脸庞,宛如真正的电影镜头。胶片颗粒的质感也十分逼真。肤色和层次感的渲染细腻入微,远超我对 AI 模型的预期。下颌线条在光线的映衬下,呈现出极具电影感的视觉效果。

提示词

图像输出

黎明时分,一位年迈的渔夫站在雾气弥漫的码头上,饱经风霜的脸上布满皱纹,身穿一件褪色的黄色雨衣。自然光,纪实摄影风格,柯达胶片质感。一位身穿黄色雨衣的老人站在雾气弥漫的码头上。

这张照片更让我惊喜。人物的皮肤纹理真实地展现了年龄感——没有丝毫修饰或理想化。皱纹看起来自然流畅,与人物性格相符。那件黄色雨衣质感十足,面料纹理清晰可见。浓雾营造出景深,却又不会喧宾夺主。它看起来真像一张《国家地理》杂志的照片。

提示词

图像输出

一位年轻女子在熙熙攘攘的东京街头市场里开怀大笑,背景虚化,沐浴在金色的夕阳余晖中。街头摄影,35 毫米胶片质感,抓拍瞬间,浅景深。一位女士在熙熙攘攘的人群中露出灿烂的笑容。

动态模糊处理得恰到好处,毫不生硬。日落时的光线温暖而真实。背景的虚化效果也十分到位,没有完全破坏整体氛围。

需要注意的是:在全分辨率下,仍然会有一种梦幻般的质感,暴露出 AI 的痕迹。在极度放大时,皮肤会略显塑料感。对于 11×14 英寸以下的网页、社交媒体或印刷品来说,这并非致命缺陷。但对于巨幅广告牌或极近特写来说,这种柔化效果就会变得明显。如果您追求照片级的真实感,那么这款产品并不适合您。但对于艺术电影般的肖像摄影来说,它的表现确实非常出色。

评分:8.5/10 — 非常适合艺术创作,细节丰富,梦幻感十足。

在 Pollo AI 免费试用 Midjourney 💳 一次订阅,畅享所有模型 • 🌟 商业用途许可授权

测试 2:奇幻与概念艺术——Midjourney 的舒适区

这正是 Midjourney 一直以来的优势所在。我测试了复杂的场景构图、氛围营造和世界构建细节,以检验它能否在无需大量提示词信息处理的情况下,处理细致入微的指令。

提示词

图像输出

暮色降临,一位孤寂的骑士伫立在摇摇欲坠的悬崖边缘,俯瞰着一片废墟王国。巨龙在远方的地平线上盘旋。史诗奇幻风格,油画技法,戏剧性的立体光影,Artstation 美学风格。日落时分,一位武士站在悬崖上,俯瞰着神秘的景色。

初次尝试便达到了画廊水准。悬崖崩塌的痕迹逼真自然,裂纹清晰可见。远处巨龙的比例和位置都恰到好处——它们看起来足够远,气势磅礴。立体光影效果也名副其实——光线穿透大气层,营造出深邃的景深。油画般的质感是刻意为之,而非后期添加的滤镜。

提示词

图像输出

一座古老的水下图书馆,发光的鱼儿在高耸的书架间穿梭,书架上摆满了闪闪发光的古籍,远处水面倾泻而下几缕苍白的光芒。画面细节丰富,笔触如画,营造出一种超凡脱俗的氛围。一座水下图书馆,里面漂浮着书籍,游动着鱼儿。

这让我震惊不已。生物发光不仅仅是发光的纹理——它实际上是从内部照亮了手稿,营造出逼真的光影效果。鱼的摆放位置显得经过精心设计,而非随意摆放。书架的结构稳固可靠。从上方射下的淡淡光束营造出真实的深度透视和大气散射效果。我真的没想到 AI 模型能如此逼真地渲染出“超凡脱俗”的景象。

提示词

图像输出

雨后东京一条小巷里,赛博朋克风格的街头集市映衬着湿漉漉的鹅卵石路面,全息投影的摊位上,无人机在空中盘旋。宽银幕画面,层层雾气,营造出《银翼杀手》般的视觉效果。一条充满活力、充满未来感的市场街道,灯光璀璨,无人机穿梭其间。

霓虹灯在湿滑路面上的反射效果完美呈现,光线反射逼真自然。全息投影摊位看起来空灵缥缈,却又清晰可见,不会模糊不清。雾气的层叠营造出视觉深度,却又不遮蔽画面。无人机在空间中的定位自然流畅,而非突兀地漂浮。

评分:9/10——确实非常出色。这正是 Midjourney 的设计初衷。

测试 3:建筑与室内设计

室内设计师们对 Midjourney 的空间逻辑和精准的灯光效果赞不绝口。我测试了这种赞誉是否名副其实,尤其关注其结构完整性和材料的真实性。

提示词

图像输出

极简主义的日式茶室内部,榻榻米地面,障子门透进柔和的午后阳光,角落里摆放着一束插花。建筑摄影,自然纹理,简洁构图。阳光充足的房间里摆放着一盆植物,地板上投射出斑驳的光影。

Midjourney 的空间逻辑把握得非常出色。光线透过障子门,呈现出逼真的光影图案,与真实的光线变化相得益彰。榻榻米的比例精准到位,尺寸也恰到好处。插花作品自然地融入留白之中。材质的质感——榻榻米的编织纹理、障子的半透明纸张——都显得真实自然,而非千篇一律或平淡无奇。

提示词

图像输出

粗犷主义风格的混凝土公寓大厅,高高的天花板,破裂的瓷砖,一盏闪烁的荧光灯。忧郁的氛围,纪实风格,胶片摄影,富有氛围感。一条光线昏暗的走廊,有两扇门和一盏发光的天花板灯。

在这里,我真正领悟到了其中的精髓。 Midjourney 捕捉到了一种非常独特的审美和情感基调——那种难以言喻却又瞬间就能辨识的忧郁而原始的感觉。龟裂的瓷砖呈现出自然老化的质感,磨损痕迹也十分逼真。混凝土则保留了粗犷主义建筑特有的原始未完成的质感。孤零零的荧光灯投射出孤寂的阴影,营造出一种独特的氛围。整个氛围精心设计,浑然一体。

提示词

图像输出

夜幕降临,摩洛哥豪华庭院尽收眼底:精致繁复的泽利吉马赛克瓷砖装饰,中央喷泉,头顶悬挂着串灯,温暖的金色灯笼灯光映照着庭院。广角镜头,细节丰富,氛围宜人。装饰华丽的庭院,内有喷泉、植物和串灯。

瓷砖的几何图案精准而复杂。这并非易事——几何图案历来都是 AI 模型难以处理的难题。喷泉自然而然地成为视觉焦点,毫不突兀。串灯和灯笼营造出温暖的层次感。整个庭院给人一种真正舒适宜人的感觉,而非冷冰冰或人工雕琢。

问题:在一次改造中,一根天花板横梁悬空于墙体连接处六英寸之外。虽然结构上存在细微缺陷,但近距离观察仍能发现。此外,空间透视偶尔会出现问题——例如,门有时与房间比例不符,或者窗户位置不合理。这种情况虽然不常见,但在重要的建筑设计中值得注意。

评分:9/10 — 空间理解能力出色,但偶尔存在结构上的小瑕疵。

测试 4:风格迁移——细微差别测试

风格迁移比看起来要难得多。我测试了 Midjourney 能否在不只是复制表面细节的情况下,始终如一地应用特定的美学参考。这需要真正的艺术理解,而不仅仅是图案匹配。

提示词

图像输出

一家熙熙攘攘的咖啡馆,人们在读报纸,大理石桌上摆着浓缩咖啡杯。风格类似爱德华·霍珀——人群中的孤独,柔和的光线,静谧的张力,忧郁的情绪基调。一家生意兴隆的咖啡馆,人们一边看报纸一边喝咖啡。

这是整个测试中最让我印象深刻的一幅作品。Midjourney 并不只是套用了霍珀的配色或笔触风格;它捕捉到了更难实现的东西——定义霍珀作品的那种情绪上的静谧感。群体中的孤独感。平淡而略带忧郁的光线。它感觉就像是霍珀本人,而不是后期加上了霍珀的滤镜。

提示词

图像输出

秋日山谷,树木色彩斑斓,一条泥泞小路蜿蜒通向一座农舍。风格类似安德鲁·怀斯——柔和的色调、忧郁的现实主义、蛋彩画的质感、内省的氛围。秋日美景,连绵起伏的山丘和一座房屋尽收眼底。

怀斯的诠释与原作相近,但色彩饱和度略高,而他本人通常偏爱较为内敛、干涩的色调。小路和农舍的构图符合怀斯对私密、具体场景的偏爱。肌理呈现出绘画般的质感,却又不显得矫揉造作或过度渲染。

提示词

图像输出

雨中的街景,老式汽车,一个穿着长外套的男人站在遮阳篷下。风格类似黑色漫画——高对比度、墨水晕染、浓重的阴影、戏剧性的光线。雨中,一个身穿风衣的身影站在城市街道上。

可直接使用。 高对比度运用得恰到好处。浓重的黑色和阴影营造出一种阴郁的氛围。男人的轮廓和姿态符合黑色电影的风格,极具电影感。老爷车在深色背景下显得格外醒目,又不失黑色电影的美感。

结论:Midjourney 在风格迁移方面比竞争对手做得更好,因为它理解情绪和意图,而不仅仅是美学规则。你可以告诉它“捕捉 X 艺术家的感觉”,它会尝试进行情感上的转化,而不仅仅是视觉上的模仿。

评分:9/10 — 情感风格的转换确实令人印象深刻。

测试 5:产品与商业摄影——Midjourney 的难点

这就是现实。商业项目需要精准的操作,而这正是 Midjourney 一直以来都难以企及的。我测试了三种产品类别,以了解其真正的局限性。

提示词

图像输出

一张极简主义风格的豪华陶瓷咖啡杯产品照片,白色背景,左侧柔和的窗光,可见单个把手,比例完美,商业摄影风格,焦点清晰。一只纯白色的咖啡杯放在白色的桌子上,周围投下柔和的光影。

提示词

图像输出

一个光滑的不锈钢水瓶放在木质表面上,瓶盖盖上,可以看到反光,产品摄影干净利落,阴影极少,灯光专业。一个造型简洁的不锈钢水瓶放在木质表面上。

提示词

图像输出

一款豪华手表陈列在大理石底座上,金表壳,皮表带,四分之三角度拍摄,专业产品照明,阴影渲染到位,商业摄影。一款配有棕色皮表带的豪华计时腕表,置于大理石底座上。

事实是:如果您需要用于电商或商业用途的精准产品照片,Midjourney 并非理想之选。对于情绪板、概念探索或产品并非主要元素的日常拍摄,它表现尚可。但对于注重产品细节的精准商业拍摄,Midjourney 的弱点便暴露无遗。

评分:6/10 — 可用于勘探,不可用于最终商业生产。

测试 6:文本渲染问题——某些用户面临的致命缺陷

Midjourney 的文本渲染是其最明显的弱点。我通过运行一些要求输入清晰文本的特定提示来测试这一点。以下是实际发生的情况。

提示词

图像输出

一家现代咖啡馆的店面。大窗户上用简洁的无衬线字体写着“CAFÉ MODERN”。现代咖啡馆外观,拥有大窗户和现代装饰。

结果:文本显示为“CAFÉ”,字母扭曲变形;“MODERN”则显示为无法辨认的波浪线。五次尝试均未产生可读文本。

提示词

图像输出

奢华护肤品瓶身,产品标签上用优雅的无衬线字体写着“PURE RADIANCE SERUM”(纯净光彩精华液)。一瓶设计简洁的纯净光彩精华液,置于中性背景上。

结果:标签上的文字严重变形,无法辨认。“PURE”可能还能勉强辨认一部分,但“RADIANCE”变成了字母扭曲的“RADANCE”,而“SERUM”则完全无法辨认。

如果您的设计需要清晰易读的文本,请改用 Nano Banana 2 或者 GPT Image 2.0,Midjourney 会阻碍依赖文本的工作流程。

文本渲染得分:2/10 — 对于文本较多的设计来说几乎无法使用。

关于 Midjourney 的 AI 视频生成测试

Midjourney 最近推出了视频生成。由于这项功能比较新,我需要对其进行全面测试才能给出客观的反馈。该功能可将任何已生成的图片,根据动态提示词转换为图生视频片段。我测试了三种不同的内容类型,以了解其功能和局限性。

重要背景:视频生成仍处于早期阶段。因此,应合理调整预期——它在特定场景下很有用,但尚不足以取代专业的视频制作工具。

视频测试 1:大气景观——它的优势所在

图像

视频输出

在阴沉暴雨的天空下,一座灯塔矗立在岩石海岸上。

成功之处:大气运动处理得非常出色。波浪的物理效果令人信服——既没有不切实际的抖动,也没有重复循环。云的运动感觉自然流畅,没有循环或卡顿。镜头拉远逐渐展现场景,保持了视觉趣味性。整个动画过程中光照保持一致。动画的整体氛围和基调始终如一。

技术性能:帧插值流畅,无明显卡顿。无卡顿现象。过渡自然流畅。

品质卓越:这款素材对社交媒体内容、情绪板和概念探索都非常实用。设计师可以将其用于客户演示,营销人员可以将其用于社交广告。无需任何后期制作——可直接融入工作流程。

评分:8.5/10 — 这才是视频生成应有的样子。

视频测试 2:包含多种元素的奇幻场景——中等难度

图像

视频输出

一座古老的石头建筑,笼罩在薄雾之中,周围环绕着茂密的树叶。

成功之处:层次感十足的运动效果超出预期。雾气的流动微妙而自然,既不过分夸张,又不显得僵硬。寺庙结构保持稳定,而背景元素则自然移动。月光的变化营造出动态光照效果,却又不显得刻意。镜头平移流畅,没有突兀的方向变化。

瑕疵:在某一部分,藤蔓似乎略微闪烁——并非完全失真,但也不够稳定。雾气在帧与帧之间会出现突然的爆裂或密度骤变。大多数观众不仔细观察可能不会注意到,但仔细观察就能发现。

质量尚可:对于复杂场景来说,效果超出预期。可用于电子游戏预告片或概念动画。

评分:8/10 — 处理层叠运动的效果出乎意料地好。

视频测试 3:动态人像——问题所在

图像

视频输出

一位长发女子若有所思地凝视着远方。

问题出在哪里:视频生成在这里暴露了其真正的局限性。头发虽然会动,但略有变形——感觉像是橡胶做的,而不是真发。头部转动时,眼睛也略微扭曲——那种数字人物几乎完美却又差那么一点点的“恐怖谷效应”让人感觉很不舒服。面部特征在运动时显得有些僵硬。表情转换生硬,缺乏平滑过渡。

结论:对于人类受试者而言,视频生成仍需进一步发展。它目前还无法胜任任何需要自然人体运动的场景。即便如此,就现阶段而言,它的表现也超出了预期。

评分:5/10 — 可以接受抽象/微妙的动作,但无法表现自然的人体动作。

真实用户怎么说

社区反馈褒贬不一,并非全是好评。在一次对比讨论中,一些用户更喜欢 Midjourney 较强的视觉吸引力和对提示词的理解能力;但也有人认为,它早期的生成结果反而更稳定可靠。另一次提示词讨论赞扬了 Midjourney 对描述性提示的理解,但仍有几位用户反映,在要求特定构图时,其执行力略显不足。

最明显的批评在于控制方面。参与复杂提示讨论的用户反映,在处理多个提示词和具体指令时存在问题。用户对 Midjourney 视频的评价则更为积极,认为其视觉效果一致,但也提到了运动伪影和 GPU 占用过高的问题。

这与我自己的测试结果基本吻合。Midjourney 在视觉风格至关重要时依然表现出色,但 Midjourney 实现精准的布局、清晰易读的文本以及达到制作级别的控制,仍然需要耐心。

目前如何使用 Midjourney

您可以通过 Midjourney 的官方网站或 Pollo AI访问该模型如果您希望将 Midjourney 集成到更广泛的创意工作空间中,Pollo AI 提供了一种更灵活的方式来访问该模型以及其他领先的图像生成器。

Midjourney 已可通过 Pollo AI 上的 AI 图像生成器使用。您可以输入提示词、调整图像设置并生成图像,无需在不同平台之间切换。

更大的优势在于模型的灵活性。如果 Midjourney 生成的图像在视觉上很吸引人,但缺少一条指令,你可以使用 Nano Banana 2Seedream 5.0 来测试相同的效果。这使得比较变得更加容易。你可以使用相同的提示词来评估每个模型,而无需依赖不相关的演示图像。

除了提供模型之外,Pollo 智能体还能将粗略的想法、图片、脚本或 URL 转化为更完整的内容。当我有了创作方向,但不想手动构建每个提示词和制作步骤时,我会选择这种方式。

Pollo AI 还提供免费额度供用户测试其创作工具。这让您能够以切实可行的方式探索 Midjourney,并在投入更大规模的工作流程之前将其与其他模型进行比较。

在 Pollo AI 上免费试用 Midjourney 💳 超过 1000 万创作者信赖 • 🌟 完整的创意工作流程

Midjourney AI 优势与劣势总结

真正的优势:

  • 我的测试结果显示,画面具有很强的电影质感和氛围感

  • 在奇幻、概念艺术和氛围探索方面取得了卓越的成果

  • 视觉迭代快

  • 灵活的样式和参考控件

  • 实用的图生视频动画

  • 活跃的创意社区

真正的弱点:

  • 文本可能仍需人工校正

  • 要精确复制产品,需要进行仔细的测试

  • 没有普遍可用的公共 API

  • 人体运动会产生可见的变形

  • 精确放置物体仍然很困难

  • 复杂的场景可能包含结构错误

总结

Midjourney 在艺术性、电影感和氛围营造方面表现出色,但在精确文本、空间定位和可重复的商业用途方面则略显不足。其视频工具在制作精细动画方面表现良好,但复杂的动作仍需仔细检查。

真正的问题在于 Midjourney 是否适合你的任务。它值得你尝试用于概念艺术、情绪板、社交媒体视觉素材和创意图像。但如果你需要处理大量文字的布局、精确的产品视觉效果或严格的制作工作,则可能需要额外的编辑,或者选择其他工具。

您可能也喜欢

查看更多

Artlist评测:我试用了Artlist AI 视频和图像生成器,以下是我的看法

以下是我根据亲身体验撰写的Artlist AI 评测。请继续阅读本文,了解Artlist.io 的核心价值及其视频和图像生成器的局限性。

Funy AI 评测:我花了两个星期研究它的AI视频工作流程

这篇 Funy AI 评测分享了我花 2 周测试它的 AI 视频工作流程后的发现。我会在这篇 Funy AI 评测中介绍它适合哪些场景、有哪些不足,以及为什么 Pollo AI 是更好的选择。

Elai 评测:我花了 14 天测试这款 AI 视频生成器,以下是结果

在尝试使用 Elai 之前,请先阅读这篇评测。在这篇 Elai 评测中,我分享了 Elai 的优点、局限性,以及 Elai 是否值得作为一款AI视频生成器使用。

LTX Studio 评测:我试用了 15 天,以下是我的发现

这篇 LTX Studio 评测分享了我实际体验其分镜工作流、时间线控制和创作限制的感受。阅读这篇 LTX Studio 评测,了解它的优缺点,以及它是否值得一试。