Midjourney 評論:我花了 14 天測試它的圖像和影片功能,以下是我的發現
我花了兩個星期的時間,在真實場景中測試了 Midjourney AI 也就是設計師、營銷人員和內容創作者實際工作中的那些場景。我測試了五大類圖像生成,以及三種不同內容類型的視頻生成。沒有刻意挑選,也沒有使用 Photoshop 等後期處理,只有原始輸出結果,並坦誠地分享哪些有效,哪些無效。以下是我的發現。
TL;DR:Midjourney AI 值得使用嗎?
值得使用,如果:你需要藝術性強、電影質感、畫廊級別的圖片。你從事概念設計、社交媒體圖片、情緒板製作或奇幻藝術創作。速度和美感比精確度更重要。
不值得使用,如果:您需要照片級真實的產品圖、圖中清晰可讀的文字、精準的元素擺放,或希望進行自由探索;您還需要通過 API 實現自動化工作流
最適合:重視藝術衝擊力而非技術精確性的設計師、概念藝術家、創意總監、營銷人員、插畫師。
指標 | 等級 | 筆記 |
| 圖像質量(藝術性) | 10/10 | 一流的電影和奇幻作品 |
| 圖像質量(真實感) | 6.5/10 | 產品和照片級真實感方面的挑戰 |
| 視頻生成 | 7.5/10 | 非常適合拍攝風景,但不太擅長拍攝人物 |
| 文本渲染 | 4/10 | 成功率低於 10% |
| 易用性 | 9/10 | 基於 Discord 的直觀工作流程 |
| 速度 | 8.5/10 | 使用草稿模式快速迭代 |
| 自定義與控制 | 6/10 | 對提示詞理解良好,但精確控制能力有限 |
| 總分 | 8.5/10 | 藝術作品的黃金標準,要了解它的侷限性 |
我如何測試 Midjourney
我使用 AI 圖像生成器對五類圖像和三段視頻進行了結構化測試。每項測試都包含多個提示,難度從簡單到刻意複雜不等。所有輸出結果均為全新生成,未經過任何後期處理或編輯。我從四個方面評估每個結果:提示詞一致性、輸出可用性、重複生成結果的一致性以及實際應用性。
我沒有刻意挑選結果。這篇評測中的每一張圖片和視頻都代表了我的真實體驗——包括成功和失敗的案例。
Midjourney 的 AI 圖像生成測試
測試 1:電影感人像攝影
人像拍攝是模型展現自身實力或慘遭失敗的舞台。我測試了三種情感各異的場景,這些場景既需要技術上的精準,也需要藝術上的細膩。我的目標是檢驗 Midjourney 能否超越千篇一律的美顏照,真正捕捉到人物的情緒。
提示詞 | 圖像輸出 |
| 一張特寫肖像,一位男士坐在燈光昏暗的爵士酒吧裏,若有所思地望着遠方。温暖的琥珀色光線勾勒出他的下頜線條。膠片顆粒感,淺景深,徠卡美學風格。 | ![]() |
效果驚豔。琥珀色的光線環繞着他的臉龐,宛如真正的電影鏡頭。膠片顆粒的質感也十分逼真。膚色和層次感的渲染細膩入微,遠超我對 AI 模型的預期。下頜線條在光線的映襯下,呈現出極具電影感的視覺效果。
提示詞 | 圖像輸出 |
| 黎明時分,一位年邁的漁夫站在霧氣瀰漫的碼頭上,飽經風霜的臉上佈滿皺紋,身穿一件褪色的黃色雨衣。自然光,紀實攝影風格,柯達膠片質感。 | ![]() |
這張照片更讓我驚喜。人物的皮膚紋理真實地展現了年齡感——沒有絲毫修飾或理想化。皺紋看起來自然流暢,與人物性格相符。那件黃色雨衣質感十足,面料紋理清晰可見。濃霧營造出景深,卻又不會喧賓奪主。它看起來真像一張《國家地理》雜誌的照片。
提示詞 | 圖像輸出 |
| 一位年輕女子在熙熙攘攘的東京街頭市場裏開懷大笑,背景虛化,沐浴在金色的夕陽餘暉中。街頭攝影,35 毫米膠片質感,抓拍瞬間,淺景深。 | ![]() |
動態模糊處理得恰到好處,毫不生硬。日落時的光線温暖而真實。背景的虛化效果也十分到位,沒有完全破壞整體氛圍。
需要注意的是:在全分辨率下,仍然會有一種夢幻般的質感,暴露出 AI 的痕跡。在極度放大時,皮膚會略顯塑料感。對於 11×14 英寸以下的網頁、社交媒體或印刷品來説,這並非致命缺陷。但對於巨幅廣告牌或極近特寫來説,這種柔化效果就會變得明顯。如果您追求照片級的真實感,那麼這款產品並不適合您。但對於藝術電影般的肖像攝影來説,它的表現確實非常出色。
評分:8.5/10 — 非常適合藝術創作,細節豐富,夢幻感十足。
測試 2:奇幻與概念藝術——Midjourney 的舒適區
這正是 Midjourney 一直以來的優勢所在。我測試了複雜的場景構圖、氛圍營造和世界構建細節,以檢驗它能否在無需大量提示詞信息處理的情況下,處理細緻入微的指令。
提示詞 | 圖像輸出 |
| 暮色降臨,一位孤寂的騎士佇立在搖搖欲墜的懸崖邊緣,俯瞰着一片廢墟王國。巨龍在遠方的地平線上盤旋。史詩奇幻風格,油畫技法,戲劇性的立體光影,Artstation 美學風格。 | ![]() |
初次嘗試便達到了畫廊水準。懸崖崩塌的痕跡逼真自然,裂紋清晰可見。遠處巨龍的比例和位置都恰到好處——它們看起來足夠遠,氣勢磅礴。立體光影效果也名副其實——光線穿透大氣層,營造出深邃的景深。油畫般的質感是刻意為之,而非後期添加的濾鏡。
提示詞 | 圖像輸出 |
| 一座古老的水下圖書館,發光的魚兒在高聳的書架間穿梭,書架上擺滿了閃閃發光的古籍,遠處水面傾瀉而下幾縷蒼白的光芒。畫面細節豐富,筆觸如畫,營造出一種超凡脱俗的氛圍。 | ![]() |
這讓我震驚不已。生物發光不僅僅是發光的紋理——它實際上是從內部照亮了手稿,營造出逼真的光影效果。魚的擺放位置顯得經過精心設計,而非隨意擺放。書架的結構穩固可靠。從上方射下的淡淡光束營造出真實的深度透視和大氣散射效果。我真的沒想到 AI 模型能如此逼真地渲染出“超凡脱俗”的景象。
提示詞 | 圖像輸出 |
| 雨後東京一條小巷裏,賽博朋克風格的街頭集市映襯着濕漉漉的鵝卵石路面,全息投影的攤位上,無人機在空中盤旋。寬銀幕畫面,層層霧氣,營造出《銀翼殺手》般的視覺效果。 | ![]() |
霓虹燈在濕滑路面上的反射效果完美呈現,光線反射逼真自然。全息投影攤位看起來空靈縹緲,卻又清晰可見,不會模糊不清。霧氣的層疊營造出視覺深度,卻又不遮蔽畫面。無人機在空間中的定位自然流暢,而非突兀地漂浮。
評分:9/10——確實非常出色。這正是 Midjourney 的設計初衷。
測試 3:建築與室內設計
室內設計師們對 Midjourney 的空間邏輯和精準的燈光效果讚不絕口。我測試了這種讚譽是否名副其實,尤其關注其結構完整性和材料的真實性。
提示詞 | 圖像輸出 |
| 極簡主義的日式茶室內部,榻榻米地面,障子門透進柔和的午後陽光,角落裏擺放着一束插花。建築攝影,自然紋理,簡潔構圖。 | ![]() |
Midjourney 的空間邏輯把握得非常出色。光線透過障子門,呈現出逼真的光影圖案,與真實的光線變化相得益彰。榻榻米的比例精準到位,尺寸也恰到好處。插花作品自然地融入留白之中。材質的質感——榻榻米的編織紋理、障子的半透明紙張——都顯得真實自然,而非千篇一律或平淡無奇。
提示詞 | 圖像輸出 |
| 粗獷主義風格的混凝土公寓大廳,高高的天花板,破裂的瓷磚,一盞閃爍的熒光燈。憂鬱的氛圍,紀實風格,膠片攝影,富有氛圍感。 | ![]() |
在這裏,我真正領悟到了其中的精髓。 Midjourney 捕捉到了一種非常獨特的審美和情感基調——那種難以言喻卻又瞬間就能辨識的憂鬱而原始的感覺。龜裂的瓷磚呈現出自然老化的質感,磨損痕跡也十分逼真。混凝土則保留了粗獷主義建築特有的原始未完成的質感。孤零零的熒光燈投射出孤寂的陰影,營造出一種獨特的氛圍。整個氛圍精心設計,渾然一體。
提示詞 | 圖像輸出 |
| 夜幕降臨,摩洛哥豪華庭院盡收眼底:精緻繁複的澤利吉馬賽克瓷磚裝飾,中央噴泉,頭頂懸掛着串燈,温暖的金色燈籠燈光映照着庭院。廣角鏡頭,細節豐富,氛圍宜人。 | ![]() |
瓷磚的幾何圖案精準而複雜。這並非易事——幾何圖案歷來都是 AI 模型難以處理的難題。噴泉自然而然地成為視覺焦點,毫不突兀。串燈和燈籠營造出温暖的層次感。整個庭院給人一種真正舒適宜人的感覺,而非冷冰冰或人工雕琢。
問題:在一次改造中,一根天花板橫樑懸空於牆體連接處六英寸之外。雖然結構上存在細微缺陷,但近距離觀察仍能發現。此外,空間透視偶爾會出現問題——例如,門有時與房間比例不符,或者窗户位置不合理。這種情況雖然不常見,但在重要的建築設計中值得注意。
評分:9/10 — 空間理解能力出色,但偶爾存在結構上的小瑕疵。
測試 4:風格遷移——細微差別測試
風格遷移比看起來要難得多。我測試了 Midjourney 能否在不只是複製表面細節的情況下,始終如一地應用特定的美學參考。這需要真正的藝術理解,而不僅僅是圖案匹配。
提示詞 | 圖像輸出 |
| 一家熙熙攘攘的咖啡館,人們在讀報紙,大理石桌上擺着濃縮咖啡杯。風格類似愛德華·霍珀——人羣中的孤獨,柔和的光線,靜謐的張力,憂鬱的情緒基調。 | ![]() |
這是整個測試中最讓我印象深刻的一幅作品。Midjourney 並不只是套用了霍珀的配色或筆觸風格;它捕捉到了更難實現的東西——定義霍珀作品的那種情緒上的靜謐感。羣體中的孤獨感。平淡而略帶憂鬱的光線。它感覺就像是霍珀本人,而不是後期加上了霍珀的濾鏡。
提示詞 | 圖像輸出 |
| 秋日山谷,樹木色彩斑斕,一條泥濘小路蜿蜒通向一座農舍。風格類似安德魯·懷斯——柔和的色調、憂鬱的現實主義、蛋彩畫的質感、內省的氛圍。 | ![]() |
懷斯的詮釋與原作相近,但色彩飽和度略高,而他本人通常偏愛較為內斂、乾澀的色調。小路和農舍的構圖符合懷斯對私密、具體場景的偏愛。肌理呈現出繪畫般的質感,卻又不顯得矯揉造作或過度渲染。
提示詞 | 圖像輸出 |
| 雨中的街景,老式汽車,一個穿着長外套的男人站在遮陽篷下。風格類似黑色漫畫——高對比度、墨水暈染、濃重的陰影、戲劇性的光線。 | ![]() |
可直接使用。 高對比度運用得恰到好處。濃重的黑色和陰影營造出一種陰鬱的氛圍。男人的輪廓和姿態符合黑色電影的風格,極具電影感。老爺車在深色背景下顯得格外醒目,又不失黑色電影的美感。
結論:Midjourney 在風格遷移方面比競爭對手做得更好,因為它理解情緒和意圖,而不僅僅是美學規則。你可以告訴它“捕捉 X 藝術家的感覺”,它會嘗試進行情感上的轉化,而不僅僅是視覺上的模仿。
評分:9/10 — 情感風格的轉換確實令人印象深刻。
測試 5:產品與商業攝影——Midjourney 的難點
這就是現實。商業項目需要精準的操作,而這正是 Midjourney 一直以來都難以企及的。我測試了三種產品類別,以瞭解其真正的侷限性。
提示詞 | 圖像輸出 |
| 一張極簡主義風格的豪華陶瓷咖啡杯產品照片,白色背景,左側柔和的窗光,可見單個把手,比例完美,商業攝影風格,焦點清晰。 | ![]() |
提示詞 | 圖像輸出 |
| 一個光滑的不鏽鋼水瓶放在木質表面上,瓶蓋蓋上,可以看到反光,產品攝影乾淨利落,陰影極少,燈光專業。 | ![]() |
提示詞 | 圖像輸出 |
| 一款豪華手錶陳列在大理石底座上,金錶殼,皮錶帶,四分之三角度拍攝,專業產品照明,陰影渲染到位,商業攝影。 | ![]() |
事實是:如果您需要用於電商或商業用途的精準產品照片,Midjourney 並非理想之選。對於情緒板、概念探索或產品並非主要元素的日常拍攝,它表現尚可。但對於注重產品細節的精準商業拍攝,Midjourney 的弱點便暴露無遺。
評分:6/10 — 可用於勘探,不可用於最終商業生產。
測試 6:文本渲染問題——某些用户面臨的致命缺陷
Midjourney 的文本渲染是其最明顯的弱點。我通過運行一些要求輸入清晰文本的特定提示來測試這一點。以下是實際發生的情況。
提示詞 | 圖像輸出 |
| 一家現代咖啡館的店面。大窗户上用簡潔的無襯線字體寫着“CAFÉ MODERN”。 | ![]() |
結果:文本顯示為“CAFÉ”,字母扭曲變形;“MODERN”則顯示為無法辨認的波浪線。五次嘗試均未產生可讀文本。
提示詞 | 圖像輸出 |
| 奢華護膚品瓶身,產品標籤上用優雅的無襯線字體寫着“PURE RADIANCE SERUM”(純淨光彩精華液)。 | ![]() |
結果:標籤上的文字嚴重變形,無法辨認。“PURE”可能還能勉強辨認一部分,但“RADIANCE”變成了字母扭曲的“RADANCE”,而“SERUM”則完全無法辨認。
如果您的設計需要清晰易讀的文本,請改用 Nano Banana 2 或者 GPT Image 2.0,Midjourney 會阻礙依賴文本的工作流程。
文本渲染得分:2/10 — 對於文本較多的設計來説幾乎無法使用。
關於 Midjourney 的 AI 視頻生成測試
Midjourney 最近推出了視頻生成。由於這項功能比較新,我需要對其進行全面測試才能給出客觀的反饋。該功能可將任何已生成的圖片,根據動態提示詞轉換為圖生視頻片段。我測試了三種不同的內容類型,以瞭解其功能和侷限性。
重要背景:視頻生成仍處於早期階段。因此,應合理調整預期——它在特定場景下很有用,但尚不足以取代專業的視頻製作工具。
視頻測試 1:大氣景觀——它的優勢所在
圖像 | 視頻輸出 |
![]() |
成功之處:大氣運動處理得非常出色。波浪的物理效果令人信服——既沒有不切實際的抖動,也沒有重複循環。雲的運動感覺自然流暢,沒有循環或卡頓。鏡頭拉遠逐漸展現場景,保持了視覺趣味性。整個動畫過程中光照保持一致。動畫的整體氛圍和基調始終如一。
技術性能:幀插值流暢,無明顯卡頓。無卡頓現象。過渡自然流暢。
品質卓越:這款素材對社交媒體內容、情緒板和概念探索都非常實用。設計師可以將其用於客户演示,營銷人員可以將其用於社交廣告。無需任何後期製作——可直接融入工作流程。
評分:8.5/10 — 這才是視頻生成應有的樣子。
視頻測試 2:包含多種元素的奇幻場景——中等難度
圖像 | 視頻輸出 |
![]() |
成功之處:層次感十足的運動效果超出預期。霧氣的流動微妙而自然,既不過分誇張,又不顯得僵硬。寺廟結構保持穩定,而背景元素則自然移動。月光的變化營造出動態光照效果,卻又不顯得刻意。鏡頭平移流暢,沒有突兀的方向變化。
瑕疵:在某一部分,藤蔓似乎略微閃爍——並非完全失真,但也不夠穩定。霧氣在幀與幀之間會出現突然的爆裂或密度驟變。大多數觀眾不仔細觀察可能不會注意到,但仔細觀察就能發現。
質量尚可:對於複雜場景來説,效果超出預期。可用於電子遊戲預告片或概念動畫。
評分:8/10 — 處理層疊運動的效果出乎意料地好。
視頻測試 3:動態人像——問題所在
圖像 | 視頻輸出 |
![]() |
問題出在哪裏:視頻生成在這裏暴露了其真正的侷限性。頭髮雖然會動,但略有變形——感覺像是橡膠做的,而不是真發。頭部轉動時,眼睛也略微扭曲——那種數字人物幾乎完美卻又差那麼一點點的“恐怖谷效應”讓人感覺很不舒服。面部特徵在運動時顯得有些僵硬。表情轉換生硬,缺乏平滑過渡。
結論:對於人類受試者而言,視頻生成仍需進一步發展。它目前還無法勝任任何需要自然人體運動的場景。即便如此,就現階段而言,它的表現也超出了預期。
評分:5/10 — 可以接受抽象/微妙的動作,但無法表現自然的人體動作。
真實用户怎麼説
社區反饋褒貶不一,並非全是好評。在一次對比討論中,一些用户更喜歡 Midjourney 較強的視覺吸引力和對提示詞的理解能力;但也有人認為,它早期的生成結果反而更穩定可靠。另一次提示詞討論讚揚了 Midjourney 對描述性提示的理解,但仍有幾位用户反映,在要求特定構圖時,其執行力略顯不足。
最明顯的批評在於控制方面。參與複雜提示討論的用户反映,在處理多個提示詞和具體指令時存在問題。用户對 Midjourney 視頻的評價則更為積極,認為其視覺效果一致,但也提到了運動偽影和 GPU 佔用過高的問題。
這與我自己的測試結果基本吻合。Midjourney 在視覺風格至關重要時依然表現出色,但 Midjourney 實現精準的佈局、清晰易讀的文本以及達到製作級別的控制,仍然需要耐心。
目前如何使用 Midjourney
您可以通過 Midjourney 的官方網站或 Pollo AI訪問該模型。如果您希望將 Midjourney 集成到更廣泛的創意工作空間中,Pollo AI 提供了一種更靈活的方式來訪問該模型以及其他領先的圖像生成器。
Midjourney 已可通過 Pollo AI 上的 AI 圖像生成器使用。您可以輸入提示詞、調整圖像設置並生成圖像,無需在不同平台之間切換。
更大的優勢在於模型的靈活性。如果 Midjourney 生成的圖像在視覺上很吸引人,但缺少一條指令,你可以使用 Nano Banana 2 或 Seedream 5.0 來測試相同的效果。這使得比較變得更加容易。你可以使用相同的提示詞來評估每個模型,而無需依賴不相關的演示圖像。
除了提供模型之外,Pollo 智能體還能將粗略的想法、圖片、腳本或 URL 轉化為更完整的內容。當我有了創作方向,但不想手動構建每個提示詞和製作步驟時,我會選擇這種方式。
Pollo AI 還提供免費額度供用户測試其創作工具。這讓您能夠以切實可行的方式探索 Midjourney,並在投入更大規模的工作流程之前將其與其他模型進行比較。
Midjourney AI 優勢與劣勢總結
真正的優勢:
我的測試結果顯示,畫面具有很強的電影質感和氛圍感
在奇幻、概念藝術和氛圍探索方面取得了卓越的成果
視覺迭代快
靈活的樣式和參考控件
實用的圖生視頻動畫
活躍的創意社區
真正的弱點:
文本可能仍需人工校正
要精確複製產品,需要進行仔細的測試
沒有普遍可用的公共 API
人體運動會產生可見的變形
精確放置物體仍然很困難
複雜的場景可能包含結構錯誤
總結
Midjourney 在藝術性、電影感和氛圍營造方面表現出色,但在精確文本、空間定位和可重複的商業用途方面則略顯不足。其視頻工具在製作精細動畫方面表現良好,但複雜的動作仍需仔細檢查。
真正的問題在於 Midjourney 是否適合你的任務。它值得你嘗試用於概念藝術、情緒板、社交媒體視覺素材和創意圖像。但如果你需要處理大量文字的佈局、精確的產品視覺效果或嚴格的製作工作,則可能需要額外的編輯,或者選擇其他工具。























