CoAI
指南

【AI新手也能上手】圖像生成AI服務・工具總整理【2025年8月版】

近年來,圖像生成AI快速進化,成為能從文字生成插畫、照片、圖像等多元視覺內容的工具,備受矚目。本文將於2025年8月時點,精選22種初學者也能輕鬆上手的圖像生成AI服務…

2025年8月11日閱讀約11分鐘

近年來,圖像生成AI快速進化,成為能從文字生成插畫、照片、圖像等多元視覺內容的工具,備受矚目。

本文將於2025年8月時點,精選22種初學者也能輕鬆上手的圖像生成AI服務,並淺顯易懂地介紹各服務的特色與優勢。此外,文中也刊登了各服務實際生成的圖像,基本上使用相同的提示詞,方便讀者比較。

請一邊比較生成的圖像,一邊作為選擇圖像生成AI的參考。本文網羅了搭載Adobe Firefly的Adobe Express,以及ChatGPT、Gemini、Midjourney等熱門服務,為您的創作活動帶來更多靈感。

※個人認為看起來較自然的是FreepikGeminiIdeogramPicsart這幾個。

初學者也能使用的圖像生成AI服務23選

Adobe Express

Adobe Express是將Adobe Firefly生成式AI功能整合進設計製作工具的圖像生成AI服務。(付費版還可使用FLUX、Google的Imagen 3、OpenAI的模型等。)除了能從文字提示詞生成圖像,還具備為既有圖像新增元素、套用文字效果等功能。由於運用了Adobe Firefly的技術,商用也能安心使用。免費方案的生成點數雖有限制,但能輕鬆生成高品質圖像並運用於設計,是其一大特色。


Adobe Firefly

Adobe Firefly是Adobe開發的創意向生成式AI模型。主要專精於圖像生成,提供文字生成圖像的功能,以及為既有圖像新增、編輯元素的功能(生成式填色、尺寸調整與擴展等)。由於僅使用Adobe Stock、開放授權內容與公共領域內容進行訓練,生成圖像在商用時的著作權安全性極高,是其最大特色。已內建於Adobe Express等Adobe產品中,能提升創作者的工作流程效率。


Akuma.ai

Akuma.ai是源自日本、專精即時圖像生成的AI插畫生成平台。尤其擅長動漫風格的圖像生成,其「AI畫布」功能可根據使用者繪製的草圖或輸入的文字,即時生成AI插畫。基礎AI模型採用以高品質圖像生成聞名的Stable Diffusion,Akuma.ai提供的模型可供商用。操作直覺,即使是AI新手也能輕鬆創作出理想的插畫,是其一大特色。


Bing Image Creator

Bing Image Creator是Microsoft提供的免費AI圖像生成工具,能從文字提示詞在數秒內生成吸睛的視覺內容,將使用者的文字轉換為圖像。此服務以OpenAI的DALL-E 3與最新的GPT-4o模型為基礎,特色是能快速產出高品質圖像。只要擁有Microsoft帳號即可免費使用,每天可進行一定數量的高速圖像生成,從寫實圖像到藝術風格作品,都能生成多種風格的圖像。


Canva Magic Media

Canva Magic Media是整合於設計平台Canva中的AI圖像生成功能。只要輸入文字提示詞,就能自動生成符合設計需求的圖像。支援插畫風、寫實風等多種風格,使用者只需用文字描述想法,就能輕鬆製作原創視覺內容。雖未明確標示具體的AI模型名稱,但其特色是能與Canva強大的設計工具連動,以直覺的操作生成高品質圖像。


ChatGPT

ChatGPT是OpenAI開發的大型語言模型,同時也整合了圖像生成功能。過去以DALL-E 3為基礎,現在則原生使用最新的GPT-4o模型(4o Image Generation)來生成圖像。只需輸入文字提示詞,就能根據使用者的指示生成圖像,有助於將想法視覺化呈現。不僅付費方案ChatGPT Plus使用者,免費使用者也能利用GPT-4o進行圖像生成,特色是可以用對話方式調整圖像。

DALL·E 3是OpenAI開發的最新圖像生成AI模型,特色是能從文字提示詞生成極為細膩且富有層次感的圖像,對提示詞的理解能力也較先前的DALL-E系列大幅提升。DALL·E 3與ChatGPT無縫整合,可直接在ChatGPT介面中使用其生成圖像。如此一來,使用者能以更自然的對話流程下達圖像生成指示,即使是複雜的構想也能精準地以圖像呈現。DALL·E 3也支援商用,適合追求高品質圖像的使用者。


Flux

Flux是以Black Forest Labs開發的FLUX.1模型為基礎的高階AI圖像生成工具。FLUX.1支援文字生成圖像、圖像生成圖像,特色在於能呈現如照片般精細的描繪,並能在圖像中生成精確清晰的文字。其採用名為rectified flow transformer的AI模型,具備高品質的圖像生成能力與優異的提示詞理解力,有時會與Midjourney相比較,被認為兼具速度、品質與易用性。


Fotor

Fotor是無需付費、免註冊即可使用的線上AI圖像生成與編輯工具。除了能從文字提示詞生成圖像的「文字生成圖像」功能外,也提供將既有圖像轉換為多種藝術風格(3D動畫、鉛筆素描、寫實風格等)的「圖像生成圖像」功能。搭載最先進的AI技術,使用者只需簡單操作即可生成高品質的AI插畫與寫真風格圖像。雖未明確標示具體的AI模型名稱,但憑藉直覺的介面與豐富的功能,能滿足從新手到專業人士的廣泛使用者需求。


Freepik

Freepik提供能從文字生成圖像的AI圖像生成工具。此服務可從多種生成模型與風格中選擇,使用者能嘗試多樣的AI模型(例如:Flux Kontext、Mystic、Google Imagen、Seedream、Ideogram 3、GPT、Runway等)。其特色在於僅使用已取得授權的內容訓練AI模型,因此生成圖像的著作權安全性較高。此外,透過「Reimagine」功能,還能從既有圖像無限生成類似圖像。付費方案提供無限量的圖像生成,能有效率地製作出專業品質的圖像。


Gemini

Gemini是Google開發的多模態生成式AI模型,能處理文字、圖像、語音、影片等多種形式的資訊。也具備圖像生成功能,可從文字提示詞生成高品質圖像。基礎AI模型採用Google的Imagen 4與Imagen 3,使用者只需用文字表達想法,即可迅速生成從寫實風景到藝術風格等各式圖像。由於能以對話形式生成與編輯圖像,是可廣泛運用於工作與日常各種場景的創新工具。


Grok

Grok(Grok)是由伊隆・馬斯克領軍的xAI開發的對話式AI,2025年7月推出的最新模型「Grok-4」不僅支援文字生成,也新增了高品質圖像生成功能。由於能參考網路與X(前身為Twitter)的最新資訊,特色是能即時製作出符合趨勢與新聞話題的視覺內容。從簡單的提示詞到細部客製化皆可廣泛支援,能生成從偏寫實的照片風格到風格化藝術作品等多元創作風格。除了創意製作外,也很適合用於社群媒體貼文的圖像生成。


Ideogram

Ideogram是從文字生成圖像的AI工具,以擅長生成圖像內的文字與字體排印聞名。AI會根據使用者輸入的提示詞生成圖像,並提供可用於平面設計、廣告、行銷等專業用途的高品質輸出。提供Ideogram 2.0、3.0等多種模型,支援從寫實圖像到平面設計等廣泛風格。每天最多可免費生成24張圖(6次),每次提示詞會生成4種不同版本。


ImageFX(Google)

ImageFX是Google開發的免費圖像生成AI服務,以Google最新AI模型Imagen 2、Imagen 3為基礎,能從文字提示詞生成高品質圖像。特色在於能精準且富有創意地生成人像、風景、抽象設計等多種類型的圖像。還具備便於調整提示詞的「expressive chip」功能,使用者能直覺地生成與編輯圖像。生成的圖像會嵌入SynthID,確保AI內容的可追溯性。


KREA AI

KREA AI是可進行即時圖像生成、影片製作、圖像編輯與強化的生成式AI平台。除了能從文字提示詞生成圖像外,也可參考使用者提供的圖像進行生成。支援Flux AI、ChatGPT、Imagen、Ideogram等多種AI模型,能以多樣風格生成圖像。其獨家AI模型「Krea 1」尤其致力於消除傳統AI圖像常見的「AI感」,追求更寫實、更具藝術性的表現。免費方案也能使用圖像生成與放大功能。

Krea AI可使用多種圖像生成模型,本圖像則是由Krea 1所生成。


Leonardo AI

Leonardo AI是能生成高品質圖像的AI圖像生成工具。搭載以Stable Diffusion為基礎的高效能圖像生成模型,能從文字提示詞生成精緻圖像。提供支援角色、立體插畫、風景、CG風、動漫繪圖、寫實風格等多種風格的多個生成模型(例如:PhotoReal Model、Leonardo Lightning XL、Lucid Origin等)。每天可免費使用150個代幣,生成的圖像可供商用。介面直覺,即使是新手也容易上手,是其特色。


Microsoft Designer

Microsoft Designer是Microsoft提供的平面設計工具,整合了AI圖像生成功能。以OpenAI的DALL-E 3模型為基礎,能從文字提示詞生成高品質圖像。AI會自動提案並製作社群媒體貼文圖像、邀請函、貼紙等各種用途的設計。使用者只需用文字表達想法,就能在數秒內生成客製化圖像。只要擁有Microsoft帳號即可免費使用,也能與Microsoft 365應用程式連動。


Midjourney

Midjourney是由美國同名研究室開發、能生成高品質圖像的AI工具。只需輸入文字提示詞(指令),即可自動生成插畫或如照片般精緻的圖像。採用獨家AI模型,因其豐富的表現力而受到眾多創作者採用。特色是每次指令會生成4種版本的圖像。近期還推出了能從圖像生成影片的AI影片模型「V1」,讓圖像得以加上動態效果。


NovelAI

NovelAI是Anlatan公司提供之NovelAI平台的AI圖像生成服務。尤其專精於2次元動漫與獸人系角色的生成,能製作出高品質插畫。基礎AI模型為NovelAI,以SDXL為基底並融入獨家技術。除了能從文字提示詞生成圖像外,還能透過標籤細膩控制生成圖像的畫風與品質。支援廣泛的藝術風格,深受動漫與插畫創作者喜愛。


Perplexity

Perplexity(Perplexity)以對話式AI搜尋引擎聞名,最新版本也支援與搜尋功能連動的圖像生成。能根據搜尋結果的資訊,即時生成相關性高的視覺內容,魅力在於可同時完成調查與創意製作。透過與Stable Diffusion系、DALL·E系模型的連動,能在短時間內從文字生成高解析度圖像。查到的資訊可直接運用於資料或內容用的圖像,實現從研究到製作的效率化。


Picsart

Picsart是整合相片編輯功能與AI圖像生成功能的服務。除了能從文字提示詞生成圖像外,也運用AI進行既有圖像的編輯(去背、生成新背景等)。可選擇多達61種畫風(風格),只要註冊帳號,即可無限次使用AI圖像生成。並與Getty Images合作,開發可供商用的客製化AI模型,對著作權的考量也是其特色。是一款從新手到專業人士都能輕鬆生成與編輯高品質圖像的工具。


PixAI.Art

PixAI.Art是專精AI插畫、AI圖像生成的免費投稿暨生成網站。尤其擅長動漫風格的AI藝術生成,除了能從文字提示詞生成圖像外,還能透過即時AI畫布功能,從草圖生成極具魅力的AI藝術作品。提供以Stable Diffusion為基礎的多種AI模型與LoRA(附加訓練模型),使用者可選擇喜好的畫風製作高品質插畫。社群功能也十分完善,能參考其他使用者生成的作品與所用模型,也是其特色之一。


Recraft

Recraft是能以既有圖像或草圖為基礎,重新構成全新視覺內容的AI圖像生成服務。透過結合文字提示詞與參考圖像,可自由進行風格轉換、構圖調整、放大處理等操作。以Stable Diffusion系為基礎,可選擇多種AI模型,能實現從寫實照片到動漫風格等廣泛的表現方式。免費方案也可進行一定數量的生成,進階方案則可使用高解析度輸出與額外的編輯工具。


Reve

Recraft是能以既有圖像或草圖為基礎,重新構成全新視覺內容的AI圖像生成服務。透過結合文字提示詞與參考圖像,可自由進行風格轉換、構圖調整、放大處理等操作。以Stable Diffusion系為基礎,可選擇多種AI模型,能實現從寫實照片到動漫風格等廣泛的表現方式。免費方案也可進行一定數量的生成,進階方案則可使用高解析度輸出與額外的編輯工具。


SeaArt

SeaArt是能從文字生成圖像的免費AI藝術生成器。提供豐富的預訓練模型,使用者也能自行訓練並使用專屬的AI圖像生成模型。以Stable Diffusion模型為基礎,能快速製作高品質的AI生成圖像。也支援商用,允許將生成的圖像製成NFT販售,或運用於周邊商品。也支援日文輸入,能依照多樣風格與喜好生成圖像,是其特色。


Stable Diffusion

Stable Diffusion是Stability AI開發的開源圖像生成AI,以能從文字提示詞生成高品質圖像的深度學習模型(擴散模型)為基礎。能根據使用者輸入的文字,自動生成從照片般寫實的圖像到藝術插畫等多種風格的圖像。由於其開源特性,衍生出許多模型與客製化方案,使用者可在自己的電腦環境中使用,也可透過線上服務使用。自由度高、可供商用,是其一大特色。


Tensor Art

Tensor.Art(Tensor Art)是於2023年5月推出、可透過網頁瀏覽器或手機輕鬆使用的AI圖像生成服務。可免費使用,若想生成更多圖像,也可選擇訂閱或購買點數。除了以Stable Diffusion為基礎的高品質模型外,還能使用LoRA、Flux等先進AI技術,不受環境限制,能廣泛滿足從新手到創作者的各種需求。操作也十分簡單,註冊後即可立即開始生成圖像,支援商用也是其魅力之一。


番外篇:有助於比較圖像生成AI的工具

LMArena

LMArena是由UC Berkeley研究人員開發的開放平台,提供存取、探索並與全球領先AI模型互動的服務。尤其在圖像生成方面,最大特色是能同時比較OpenAI的GPT-4o Image Generation、Google的Imagen 4.0、Imagen 3.0、Black Forest Labs的Flux 1.1 Pro、Flux 1 Kontext系列、Bytedance的Seedream-3、Ideogram的V2、V3、Recraft的V3、DALL-E 3、Stability AI的Stable Diffusion V35 Large等10種以上最先進的AI模型。

使用者可用相同的提示詞,並列比較不同AI模型的生成結果,並為較優的結果投票,藉此為社群主導的公開排行榜做出貢獻(總投票數超過46萬8千票)。透過匿名評分系統,能根據實際使用成果將AI的進步視覺化呈現,對想客觀判斷哪款圖像生成AI最適合自己用途的新手來說,是非常實用的工具。

【注意事項】LMArena在官方使用條款中,將服務及輸出結果的使用限定於個人或公司內部業務,全面禁止銷售、再散布等商業用途。雖然可將其運用於公司內部的模型選定或研究,但不得用於將生成物作為外部服務、付費報告、廣告素材、API等直接營業行為提供之用途。

返回指南列表