Guide
怎样写出更好的 AI 图片描述?
把「好看一点」翻译成模型能执行的描述:主体、场景、风格与画面细节,以及如何逐步调整。
很多人第一次用 AI 生成图片时,会输入「画一张好看的图」。结果通常不理想——不是模型不够好,而是描述里没有可以执行的信息。
写图片描述并不需要专业术语。它更像是在向一位插画师说明需求:你想看到什么、画面里有什么、大致是什么感觉。
描述里最有用的四类信息
一条清晰的图片描述,通常包含下面四类信息。不用每次都写全,但缺得越多,结果越随机。
- 主体:画面里最重要的是什么。是人、动物、物品,还是一个场景?
- 场景与环境:主体在哪里、周围有什么、时间与天气如何。
- 风格:写实、插画、水彩、扁平、电影感、极简……用你熟悉的词即可。
- 画面细节:构图、视角、光线、色调,以及你希望强调或避开的东西。
从模糊到具体
对比两组描述,差别非常直观。
- 模糊的描述: 一只猫,好看一点。
- 更具体的描述: 一只橘色短毛猫坐在窗台上,下午的侧光,背景是虚化的室内,写实风格,画面干净、色调偏暖。
第二句没有使用任何专业词汇,但它给出了主体、场景、光线、风格和整体感觉。模型因此有足够信息去组织画面。
多出来的信息不是「堆词」,而是把「好看」拆成了可以执行的条件。
先确定一个重点,再逐步加细节
一次把所有想法都写进去,往往会让画面变得杂乱。更稳妥的做法是:
- 先写清楚主体和场景,生成一张大致方向正确的图;
- 再补充风格或光线,观察画面如何变化;
- 最后处理细节,例如构图、视角、色调。
这样每一轮你都只改一个变量,更容易判断是哪句话影响了结果。
关于画面里的文字
目前多数图片生成模型在画面内文字上仍然不稳定:拼写可能出错,字形也可能变形。如果图片需要出现文字,更可靠的方式是先生成不含文字的底图,再用排版工具加上文字。这样既可控,也不会因为几个字母重做整张图。
用「不要什么」来收窄范围
除了描述想要什么,也可以明确说明不想要什么。例如「不要多余的人」「不要强烈的彩色背景」「不要复杂的装饰」。排除项能有效减少画面里的干扰元素。
不过要注意:不要堆砌太多否定句。如果排除项太多,模型反而难以判断画面应该是什么样子。通常保留一到两条最关键的排除条件就够了。
迭代比一次到位更现实
把生成图片当成一个来回调整的过程,而不是一次考试。看到结果后,你可以:
- 保留满意的部分,只调整其中一点;
- 把上一版描述改一两个字再生成一次;
- 如果方向完全不对,回到「主体 + 场景」重新描述。
在 OHLAC 里,生成结果会留在你的账号中,所以你可以随时回到某一次结果继续调整,而不必从零开始。
小结
更好的图片描述,本质上是一次更清楚的沟通:先说主体和场景,再补风格与细节,然后一次只改一个变量。它不依赖技巧,只依赖你是否说清楚了想要什么。
如果想进一步了解以现有图片为起点创作,可以阅读使用参考图生成图片时应该注意什么。积分与消耗规则见积分与扣费。
Guide
How to write better image prompts
Turn "make it nicer" into something a model can act on: subject, scene, style and detail — and how to iterate.
Most people start by typing "make a nice picture". The result is usually disappointing — not because the model is weak, but because the description contains nothing it can act on.
Writing an image prompt does not require technical terms. It is closer to briefing an illustrator: what you want to see, what is in the frame, and roughly how it should feel.
The four kinds of information that help most
A clear prompt usually carries four kinds of information. You do not need all of them every time, but the more you leave out, the more random the result.
- Subject: what matters most in the frame — a person, an animal, an object, or a scene.
- Setting and environment: where the subject is, what surrounds it, time of day and weather.
- Style: realistic, illustration, watercolour, flat, cinematic, minimal — whatever words you already know.
- Picture detail: composition, angle, light, colour, and anything you want emphasised or avoided.
From vague to specific
Compare two descriptions; the difference is immediate.
- Vague: A cat. Make it nicer.
- More specific: An orange short-haired cat sitting on a windowsill, late-afternoon side light, blurred indoor background, realistic style, clean composition with warm tones.
The second prompt uses no jargon, but it gives a subject, a setting, light, style and overall feeling. That is enough for the model to organise the frame.
The extra words are not padding — they turn "nicer" into conditions the model can act on.
Fix one thing first, then add detail
Cramming every idea into one prompt usually makes the image busy. A steadier approach:
- Describe the subject and setting, and generate a version that is roughly right;
- Add style or light and watch how the image changes;
- Handle detail last — composition, angle, colour.
You change one variable per round, so it stays clear which sentence moved the result.
A note on text inside the image
Most image models are still unreliable at text within the image: spelling can break and letterforms can warp. If the picture needs words, the more dependable route is to generate a clean background without text, then add the type in a layout tool. That keeps the wording under your control and avoids redrawing the whole image over a few letters.
Narrow the range with exclusions
Besides describing what you want, you can state what you do not want: "no extra people", "no strong coloured background", "no busy ornaments". Exclusions are effective at removing distractions.
One caution: do not pile up negatives. If there are too many, the model struggles to tell what the image should be. One or two of the most important exclusions is usually enough.
Iterating beats getting it right in one shot
Treat image generation as a back-and-forth process rather than a single test. After seeing a result you can:
- keep what works and adjust just one thing;
- change a word or two in the prompt and generate again;
- if the direction is wrong, return to "subject + setting" and describe it afresh.
In OHLAC, generated results stay in your account, so you can return to an earlier version and keep working instead of starting over.
In short
A better image prompt is really a clearer briefing: subject and setting first, then style and detail, changing one variable at a time. It relies less on tricks than on saying clearly what you want.
To build on an existing image instead, read What to watch for when using a reference image. For credits, see Credits & billing.
Guide
이미지 설명을 더 잘 쓰는 방법
"조금 더 예쁘게"를 모델이 실행할 수 있는 설명으로 바꾸기: 피사체, 배경, 스타일, 화면 디테일과 단계적 조정 방법.
대부분 "예쁜 그림 그려 줘"라고 입력하며 시작합니다. 결과는 보통 실망스럽습니다. 모델이 약해서가 아니라, 설명에 모델이 실행할 수 있는 내용이 없기 때문입니다.
이미지 설명에 전문 용어는 필요 없습니다. 삽화가에게 작업을 맡기는 것과 비슷합니다. 무엇을 보고 싶은지, 화면에 무엇이 있는지, 대략 어떤 느낌이어야 하는지를 전하면 됩니다.
가장 도움이 되는 네 가지 정보
분명한 설명에는 보통 네 가지 정보가 담깁니다. 매번 다 필요하지는 않지만, 빠뜨릴수록 결과가 무작위해집니다.
- 피사체: 화면에서 가장 중요한 것 — 사람, 동물, 사물, 장면.
- 배경과 환경: 피사체가 어디에 있는지, 주변이 어떤지, 시간대와 날씨.
- 스타일: 실사, 일러스트, 수채화, 플랫, 영화적, 미니멀 — 이미 아는 단어로 충분합니다.
- 화면 디테일: 구도, 앵글, 빛, 색, 강조하고 싶은 것과 피하고 싶은 것.
두루뭉술한 설명에서 구체적인 설명으로
두 설명을 비교하면 차이가 바로 보입니다.
- 두루뭉술: 고양이. 더 예쁘게.
- 더 구체적: 창가에 앉은 주황색 단모 고양이, 늦은 오후의 옆빛, 흐릿한 실내 배경, 실사 스타일, 따뜻한 톤의 정돈된 구도.
두 번째 설명은 전문 용어를 하나도 쓰지 않았지만 피사체, 배경, 빛, 스타일, 전체 느낌을 담았습니다. 이것만으로 모델은 화면을 짤 수 있습니다.
덧붙인 단어는 군더더기가 아니라 "더 예쁘게"를 모델이 실행할 수 있는 조건으로 바꾼 것입니다.
하나씩 고치고, 디테일은 나중에
모든 아이디어를 한 번에 넣으면 화면이 어수선해집니다. 더 안정적인 방법:
- 피사체와 배경을 설명해 대략 맞는 버전을 만듭니다.
- 스타일이나 빛을 더해 그림이 어떻게 달라지는지 봅니다.
- 디테일(구도, 앵글, 색)은 마지막에 다룹니다.
한 번에 변수 하나만 바꾸면 어떤 문장이 결과를 움직였는지 분명해집니다.
이미지 안의 글자에 대해
대부분의 이미지 모델은 이미지 안의 글자를 아직 불안정하게 처리합니다. 철자가 깨지거나 자형이 휠 수 있습니다. 그림에 글자가 필요하다면 글자 없는 깔끔한 배경을 생성한 뒤 편집 도구에서 글자를 얹는 편이 확실합니다. 글자 몇 개 때문에 그림 전체를 다시 그릴 필요도 없습니다.
제외 조건으로 범위 좁히기
원하는 것을 적는 것 외에 원하지 않는 것도 말할 수 있습니다. "사람을 더 넣지 말 것", "강한 색 배경은 피할 것", "장식을 과하게 넣지 말 것". 제외 조건은 방해 요소를 걷어내는 데 효과적입니다.
주의할 점: 부정 표현을 너무 쌓지 마세요. 너무 많으면 모델이 그림이 어때야 하는지 알기 어려워집니다. 가장 중요한 한두 개면 충분합니다.
한 번에 맞히기보다 반복하기
이미지 생성은 한 번의 시험이 아니라 주고받는 과정이라고 보세요. 결과를 본 뒤에 할 수 있는 일:
- 잘된 부분은 남기고 한 곳만 조정합니다.
- 설명에서 단어 한두 개를 바꿔 다시 생성합니다.
- 방향이 틀렸다면 "피사체 + 배경"으로 돌아가 다시 설명합니다.
OHLAC에서는 결과가 계정에 남아 있어 처음부터 다시 하지 않고 이전 버전으로 돌아가 이어갈 수 있습니다.
정리
더 나은 이미지 설명은 결국 더 분명한 요청입니다. 피사체와 배경을 먼저, 스타일과 디테일을 다음에, 한 번에 변수 하나씩. 요령보다 중요한 것은 원하는 바를 분명히 말하는 것입니다.
이미 있는 그림에서 이어가려면 참고 이미지를 쓸 때 주의할 점을, 크레딧은 크레딧과 과금을 확인하세요.
Guide
より良い AI 画像プロンプトの書き方
「もう少し良く」をモデルが実行できる記述に変える:被写体、場面、スタイル、画面の細部、そして少しずつ調整する方法。
多くの人は「いい感じの絵を描いて」と入力するところから始めます。結果はたいてい期待外れです。モデルが弱いからではなく、記述にモデルが実行できる情報が入っていないからです。
画像プロンプトに専門用語は必要ありません。イラストレーターに依頼するのに近く、「何を見たいか」「画面に何があるか」「だいたいどんな雰囲気か」を伝えることです。
最も役立つ 4 種類の情報
明確なプロンプトは通常 4 種類の情報を持ちます。毎回すべて必要ではありませんが、省くほど結果はランダムになります。
- 被写体: 画面で最も重要なもの——人、動物、物、または情景。
- 場面と環境: 被写体がどこにあり、周囲に何があり、時間帯と天気はどうか。
- スタイル: 写実、イラスト、水彩、フラット、シネマティック、ミニマル——知っている言葉で構いません。
- 画面の細部: 構図、アングル、光、色、強調したい点や避けたい点。
曖昧から具体的へ
2 つの記述を比べると違いはすぐにわかります。
- 曖昧: 猫。もっといい感じに。
- より具体的: 窓辺に座るオレンジ色の短毛猫、午後の斜光、室内の背景はぼかす、写実スタイル、暖色系で整理された構図。
2 つ目のプロンプトは専門用語を一切使っていませんが、被写体、場面、光、スタイル、全体の雰囲気を伝えています。これだけでモデルは画面を組み立てられます。
余分な言葉は水増しではなく、「いい感じ」をモデルが実行できる条件に変えています。
まず一つを直し、それから細部を足す
すべてのアイデアを一度に詰め込むと、画面はたいてい雑然とします。安定した進め方:
- 被写体と場面を記述し、おおよそ合っている版を生成する;
- スタイルや光を足して、画像がどう変わるか見る;
- 細部(構図、アングル、色)は最後に扱う。
1 回につき 1 つの変数だけ変えると、どの文が結果を動かしたかがはっきりします。
画像内の文字について
多くの画像モデルは画像内の文字がまだ不安定で、綴りが崩れたり字形が歪んだりします。画像に文字が必要な場合は、文字なしのきれいな背景を生成し、レイアウトツールで文字を載せるほうが確実です。数文字のために画像全体を描き直す手間も避けられます。
除外指定で範囲を絞る
欲しいものを書くだけでなく、不要なものも指定できます:「人物を増やさない」「強い色の背景にしない」「装飾を詰め込まない」。除外指定は雑念を取り除くのに効果的です。
注意点:否定を積み上げすぎないこと。多すぎるとモデルは何を描くべきか分からなくなります。重要なものを 1〜2 個に絞るのが通常は十分です。
一発で決めるより反復する
画像生成は一度きりのテストではなく、やり取りだと考えてください。結果を見たあとにできます:
- うまくいった部分は残し、1 か所だけ調整する;
- プロンプトの語を 1〜2 変えて再度生成する;
- 方向が違うなら「被写体+場面」に戻り、書き直す。
OHLAC では生成結果はアカウントに残るので、最初からやり直さず、以前の版に戻って続けられます。
まとめ
より良い画像プロンプトとは、実のところより明確な依頼です。まず被写体と場面、次にスタイルと細部、1 回に 1 つだけ変える。コツよりも、何が欲しいかをはっきり言うことがものを言います。
既存の画像を元にしたい場合は参考画像を使うときの注意点を、クレジットはクレジットと課金をご覧ください。
Guide
Cómo escribir mejores descripciones de imagen
Convertir «que se vea mejor» en algo que el modelo pueda ejecutar: sujeto, escena, estilo y detalle, y cómo iterar.
La mayoría empieza escribiendo «haz una imagen bonita». El resultado suele decepcionar, no porque el modelo sea débil, sino porque la descripción no contiene nada sobre lo que pueda actuar.
Escribir una descripción de imagen no requiere términos técnicos. Se parece más a encargar un trabajo a un ilustrador: qué quiere ver, qué hay en el encuadre y qué sensación debería transmitir.
Los cuatro tipos de información que más ayudan
Una descripción clara suele llevar cuatro tipos de información. No hacen falta todos cada vez, pero cuanto más omita, más aleatorio será el resultado.
- Sujeto: lo más importante del encuadre: una persona, un animal, un objeto o una escena.
- Entorno y ambiente: dónde está el sujeto, qué lo rodea, hora del día y clima.
- Estilo: realista, ilustración, acuarela, plano, cinematográfico, minimalista: las palabras que ya conozca.
- Detalle de la imagen: composición, ángulo, luz, color y lo que quiera destacar o evitar.
De lo vago a lo concreto
Compare dos descripciones; la diferencia es inmediata.
- Vaga: Un gato. Que quede mejor.
- Más concreta: Un gato naranja de pelo corto sentado en el alféizar, luz lateral de última hora de la tarde, fondo interior desenfocado, estilo realista, composición limpia con tonos cálidos.
La segunda no usa jerga, pero da sujeto, entorno, luz, estilo y sensación general. Con eso basta para que el modelo organice el encuadre.
Las palabras extra no son relleno: convierten «mejor» en condiciones sobre las que el modelo puede actuar.
Corrija una cosa primero y luego añada detalle
Meter todas las ideas en una sola descripción suele saturar la imagen. Un método más estable:
- Describa sujeto y entorno y genere una versión aproximada;
- Añada estilo o luz y observe cómo cambia la imagen;
- Deje el detalle para el final: composición, ángulo, color.
Cambie una sola variable por ronda y quedará claro qué frase movió el resultado.
Nota sobre el texto dentro de la imagen
La mayoría de los modelos de imagen siguen siendo poco fiables con el texto dentro de la imagen: la ortografía puede fallar y las letras deformarse. Si la imagen necesita palabras, es más fiable generar un fondo limpio sin texto y añadir la tipografía en una herramienta de maquetación. Así controla el texto y evita rehacer toda la imagen por unas letras.
Acote con exclusiones
Además de describir lo que quiere, puede indicar lo que no quiere: «sin personas extra», «sin fondo de colores fuertes», «sin adornos recargados». Las exclusiones son eficaces para quitar distracciones.
Una precaución: no acumule negaciones. Con demasiadas, el modelo no sabe qué debe ser la imagen. Una o dos de las más importantes suelen bastar.
Iterar es mejor que acertar a la primera
Trate la generación de imágenes como un ida y vuelta, no como una prueba única. Después de ver un resultado puede:
- conservar lo que funciona y ajustar solo una cosa;
- cambiar una o dos palabras de la descripción y generar de nuevo;
- si la dirección es incorrecta, volver a «sujeto + entorno» y describir de nuevo.
En OHLAC los resultados quedan en su cuenta, así que puede volver a una versión anterior y seguir trabajando en lugar de empezar de cero.
En resumen
Una mejor descripción de imagen es, en realidad, un encargo más claro: primero sujeto y entorno, después estilo y detalle, cambiando una variable cada vez. Depende menos de trucos que de decir con claridad qué quiere.
Para partir de una imagen existente, lea Qué tener en cuenta al usar una imagen de referencia. Sobre créditos, consulte Créditos y facturación.
Guide
Cara menulis prompt gambar AI yang lebih baik
Ubah "buat lebih bagus" menjadi perintah yang bisa dijalankan model: subjek, suasana, gaya, detail gambar, dan cara menyesuaikan bertahap.
Kebanyakan orang mulai dengan menulis "buat gambar yang bagus". Hasilnya biasanya mengecewakan — bukan karena modelnya lemah, tetapi karena deskripsinya tidak memuat hal yang bisa dijalankan model.
Menulis prompt gambar tidak menuntut istilah teknis. Lebih mirip memberi arahan kepada ilustrator: apa yang ingin Anda lihat, apa yang ada di dalam bingkai, dan kira-kira bagaimana rasanya.
Empat jenis informasi yang paling membantu
Prompt yang jelas biasanya memuat empat jenis informasi. Tidak semuanya perlu setiap kali, tetapi makin banyak yang dihilangkan, makin acak hasilnya.
- Subjek: hal terpenting dalam bingkai — orang, hewan, benda, atau suasana.
- Suasana dan lingkungan: di mana subjek berada, apa di sekitarnya, waktu dan cuaca.
- Gaya: realistis, ilustrasi, cat air, datar, sinematik, minimalis — kata yang Anda sudah tahu.
- Detail gambar: komposisi, sudut, cahaya, warna, serta apa yang ingin ditekankan atau dihindari.
Dari samar ke spesifik
Bandingkan dua deskripsi; bedanya langsung terasa.
- Samar: Kucing. Buat lebih bagus.
- Lebih spesifik: Kucing oranye berbulu pendek duduk di ambang jendela, cahaya samping sore, latar dalam ruangan kabur, gaya realistis, komposisi bersih dengan nuansa hangat.
Prompt kedua tidak memakai istilah teknis, tetapi memberi subjek, suasana, cahaya, gaya, dan kesan keseluruhan. Itu cukup bagi model untuk menyusun bingkai.
Kata tambahan bukan pengisi — itu mengubah "lebih bagus" menjadi kondisi yang bisa dijalankan model.
Perbaiki satu hal dulu, lalu tambah detail
Menjejalkan semua ide dalam satu prompt biasanya membuat gambar terlalu penuh. Cara yang lebih stabil:
- Jelaskan subjek dan suasana, lalu buat versi yang kira-kira sudah pas;
- Tambahkan gaya atau cahaya lalu lihat bagaimana gambarnya berubah;
- Tangani detail terakhir — komposisi, sudut, warna.
Ubah satu variabel per putaran agar jelas kalimat mana yang mengubah hasilnya.
Catatan tentang teks di dalam gambar
Sebagian besar model gambar masih belum andal untuk teks di dalam gambar: ejaan bisa rusak dan bentuk huruf bisa melengkung. Kalau gambar butuh kata, cara yang lebih aman adalah membuat latar bersih tanpa teks, lalu menambahkan tipografinya di alat tata letak. Dengan begitu teks tetap terkendali dan Anda tidak perlu menggambar ulang seluruh gambar hanya karena beberapa huruf.
Persempit dengan pengecualian
Selain menjelaskan yang Anda inginkan, Anda bisa menyebut yang tidak diinginkan: "tanpa orang tambahan", "tanpa latar warna mencolok", "tanpa hiasan berlebihan". Pengecualian efektif menghilangkan gangguan.
Satu catatan: jangan menumpuk terlalu banyak negasi. Kalau terlalu banyak, model bingung bagaimana gambar seharusnya. Satu atau dua yang paling penting biasanya cukup.
Mengulang lebih baik daripada sekali jadi
Perlakukan pembuatan gambar sebagai proses bolak-balik, bukan sekali uji. Setelah melihat hasil, Anda bisa:
- pertahankan yang sudah bagus dan sesuaikan satu hal saja;
- ubah satu atau dua kata pada prompt lalu buat lagi;
- kalau arahnya salah, kembali ke "subjek + suasana" lalu jelaskan ulang.
Di OHLAC hasilnya tersimpan di akun Anda, jadi Anda bisa kembali ke versi sebelumnya dan melanjutkan, bukan mulai dari nol.
Ringkasan
Prompt gambar yang lebih baik sebenarnya adalah arahan yang lebih jelas: subjek dan suasana dulu, lalu gaya dan detail, dengan satu variabel diubah setiap kali. Yang menentukan bukan trik, melainkan menyatakan dengan jelas apa yang Anda inginkan.
Untuk melanjutkan dari gambar yang sudah ada, baca Hal yang perlu diperhatikan saat memakai gambar referensi. Untuk kredit, lihat Kredit dan tagihan.
Guide
Cách viết mô tả ảnh AI tốt hơn
Biến "đẹp hơn chút" thành điều mô hình có thể thực hiện: chủ thể, bối cảnh, phong cách, chi tiết và cách tinh chỉnh dần.
Phần lớn mọi người bắt đầu bằng câu "vẽ một bức ảnh đẹp". Kết quả thường không như ý — không phải vì mô hình yếu, mà vì mô tả không chứa điều gì mô hình có thể thực hiện.
Viết mô tả ảnh không cần thuật ngữ kỹ thuật. Nó giống đặt việc cho một họa sĩ minh họa: bạn muốn thấy gì, trong khung có gì, và đại khái cảm giác ra sao.
Bốn loại thông tin hữu ích nhất
Một mô tả rõ ràng thường mang bốn loại thông tin. Không cần đủ cả mỗi lần, nhưng càng bỏ qua nhiều thì kết quả càng ngẫu nhiên.
- Chủ thể: thứ quan trọng nhất trong khung — người, con vật, đồ vật hoặc khung cảnh.
- Bối cảnh và môi trường: chủ thể ở đâu, xung quanh có gì, thời điểm và thời tiết.
- Phong cách: tả thực, minh họa, màu nước, phẳng, điện ảnh, tối giản — từ nào bạn đã biết cũng được.
- Chi tiết hình ảnh: bố cục, góc, ánh sáng, màu sắc, và điều bạn muốn nhấn mạnh hay tránh.
Từ mơ hồ đến cụ thể
So sánh hai mô tả, khác biệt thấy ngay.
- Mơ hồ: Một con mèo. Làm cho đẹp hơn.
- Cụ thể hơn: Một con mèo lông ngắn màu cam ngồi trên bậu cửa sổ, ánh sáng xiên buổi chiều muộn, nền trong nhà mờ, phong cách tả thực, bố cục gọn với tông màu ấm.
Mô tả thứ hai không dùng thuật ngữ nào nhưng đã cho chủ thể, bối cảnh, ánh sáng, phong cách và cảm giác chung. Thế là đủ để mô hình sắp xếp khung hình.
Những từ thêm vào không phải để cho dài — chúng biến "đẹp hơn" thành điều kiện mô hình có thể thực hiện.
Sửa một thứ trước, rồi thêm chi tiết
Nhồi mọi ý vào một mô tả thường làm bức ảnh rối. Cách ổn định hơn:
- Mô tả chủ thể và bối cảnh, tạo một bản đại khái đúng;
- Thêm phong cách hoặc ánh sáng rồi xem ảnh thay đổi thế nào;
- Xử lý chi tiết sau cùng — bố cục, góc, màu sắc.
Mỗi lượt chỉ đổi một biến để biết rõ câu nào đã làm thay đổi kết quả.
Lưu ý về chữ trong ảnh
Phần lớn mô hình tạo ảnh vẫn chưa đáng tin với chữ trong ảnh: chính tả có thể sai và nét chữ có thể méo. Nếu bức ảnh cần chữ, cách chắc hơn là tạo nền sạch không chữ rồi thêm chữ bằng công cụ dàn trang. Như vậy bạn kiểm soát được nội dung chữ và không phải vẽ lại toàn bộ ảnh chỉ vì vài ký tự.
Thu hẹp phạm vi bằng loại trừ
Ngoài việc mô tả điều bạn muốn, bạn có thể nêu điều không muốn: "không thêm người", "không nền màu gắt", "không trang trí rối". Loại trừ rất hiệu quả để bỏ đi thứ gây nhiễu.
Một lưu ý: đừng xếp quá nhiều phủ định. Nếu quá nhiều, mô hình sẽ khó biết bức ảnh nên là gì. Một hoặc hai điều quan trọng nhất thường là đủ.
Lặp lại tốt hơn là làm một lần cho đúng
Hãy coi việc tạo ảnh là quá trình qua lại, không phải một lần thử. Sau khi xem kết quả, bạn có thể:
- giữ phần đã tốt và chỉ chỉnh một thứ;
- đổi một hai từ trong mô tả rồi tạo lại;
- nếu sai hướng, quay lại "chủ thể + bối cảnh" và mô tả lại.
Trong OHLAC, kết quả được lưu trong tài khoản, nên bạn có thể quay lại bản trước và tiếp tục thay vì bắt đầu lại.
Tóm lại
Một mô tả ảnh tốt hơn thực chất là một yêu cầu rõ hơn: chủ thể và bối cảnh trước, rồi phong cách và chi tiết, mỗi lần đổi một biến. Điều quyết định không phải mẹo, mà là nói rõ bạn muốn gì.
Nếu muốn dựa trên ảnh có sẵn, hãy đọc Cần lưu ý gì khi dùng ảnh tham chiếu. Về tín dụng, xem Tín dụng và thanh toán.
Guide
เขียนคำบรรยายภาพ AI ให้ดีขึ้นได้อย่างไร
เปลี่ยน "ให้สวยขึ้นหน่อย" เป็นคำสั่งที่โมเดลทำได้: ตัวแบบ ฉาก สไตล์ รายละเอียดภาพ และวิธีปรับทีละขั้น
คนส่วนใหญ่เริ่มจากพิมพ์ว่า "วาดรูปสวย ๆ" ผลลัพธ์มักไม่เป็นอย่างที่คิด ไม่ใช่เพราะโมเดลอ่อน แต่เพราะคำบรรยายไม่มีข้อมูลที่โมเดลนำไปทำได้
การเขียนคำบรรยายภาพไม่ต้องใช้ศัพท์เทคนิค มันใกล้เคียงกับการสั่งงานนักวาดภาพประกอบ: อยากเห็นอะไร ในภาพมีอะไร และควรให้ความรู้สึกอย่างไร
ข้อมูลสี่ประเภทที่ช่วยได้มากที่สุด
คำบรรยายที่ชัดเจนมักมีข้อมูลสี่ประเภท ไม่จำเป็นต้องครบทุกครั้ง แต่ยิ่งละไว้มาก ผลลัพธ์ยิ่งสุ่ม
- ตัวแบบ: สิ่งสำคัญที่สุดในภาพ — คน สัตว์ วัตถุ หรือฉาก
- ฉากและสภาพแวดล้อม: ตัวแบบอยู่ที่ไหน รอบ ๆ มีอะไร ช่วงเวลาและอากาศ
- สไตล์: เหมือนจริง ภาพประกอบ สีน้ำ แบน ภาพยนตร์ มินิมัล — ใช้คำที่คุณรู้อยู่แล้ว
- รายละเอียดภาพ: องค์ประกอบ มุม แสง สี และสิ่งที่อยากเน้นหรือหลีกเลี่ยง
จากคลุมเครือเป็นเจาะจง
ลองเทียบสองคำบรรยาย จะเห็นความต่างทันที
- คลุมเครือ: แมว ทำให้สวยกว่านี้
- เจาะจงขึ้น: แมวขนสั้นสีส้มนั่งบนขอบหน้าต่าง แสงเฉียงช่วงบ่ายแก่ ๆ ฉากหลังในบ้านเบลอ สไตล์เหมือนจริง องค์ประกอบเรียบร้อยโทนอบอุ่น
คำบรรยายที่สองไม่ใช้ศัพท์เทคนิค แต่ให้ตัวแบบ ฉาก แสง สไตล์ และความรู้สึกโดยรวม ซึ่งเพียงพอให้โมเดลจัดภาพ
คำที่เพิ่มมาไม่ใช่การถ่วงความยาว แต่เปลี่ยน "สวยกว่านี้" ให้เป็นเงื่อนไขที่โมเดลทำได้
แก้ทีละอย่างก่อน แล้วค่อยเพิ่มรายละเอียด
การยัดทุกความคิดไว้ในคำบรรยายเดียวทำให้ภาพรก วิธีที่นิ่งกว่า:
- อธิบายตัวแบบและฉาก แล้วสร้างเวอร์ชันที่ใกล้เคียงก่อน
- เพิ่มสไตล์หรือแสง แล้วดูว่าภาพเปลี่ยนอย่างไร
- จัดการรายละเอียดทีหลัง — องค์ประกอบ มุม สี
เปลี่ยนตัวแปรทีละหนึ่งอย่างต่อรอบ จะเห็นชัดว่าประโยคไหนเปลี่ยนผลลัพธ์
หมายเหตุเรื่องข้อความในภาพ
โมเดลสร้างภาพส่วนใหญ่ยังไม่นิ่งกับ ข้อความในภาพ: สะกดอาจผิดและรูปตัวอักษรอาจบิด ถ้าภาพต้องมีตัวอักษร วิธีที่ชัวร์กว่าคือสร้างพื้นหลังสะอาดที่ไม่มีข้อความ แล้วเติมตัวอักษรด้วยเครื่องมือจัดวางหน้า วิธีนี้ทำให้คุณคุมข้อความได้และไม่ต้องวาดภาพใหม่ทั้งใบเพียงเพราะตัวอักษรไม่กี่ตัว
จำกัดขอบเขตด้วยการยกเว้น
นอกจากบอกสิ่งที่ต้องการ คุณยังบอกสิ่งที่ไม่ต้องการได้: "ไม่ต้องมีคนเพิ่ม" "ไม่เอาพื้นหลังสีจัด" "ไม่เอาลวดลายรก" การยกเว้นได้ผลดีในการตัดสิ่งรบกวน
ข้อควรระวัง: อย่าใส่คำปฏิเสธซ้อนกันมากเกินไป ถ้ามากเกินไปโมเดลจะไม่แน่ใจว่าภาพควรเป็นอย่างไร หนึ่งหรือสองข้อที่สำคัญที่สุดมักเพียงพอ
ทำซ้ำได้ผลกว่าทำครั้งเดียวให้เป๊ะ
มองการสร้างภาพเป็นกระบวนการไปกลับ ไม่ใช่การทดสอบครั้งเดียว หลังจากเห็นผลลัพธ์คุณสามารถ:
- เก็บส่วนที่ได้ผลไว้ แล้วปรับเพียงอย่างเดียว
- เปลี่ยนคำหนึ่งหรือสองคำในคำบรรยายแล้วสร้างใหม่
- ถ้าทิศทางผิด กลับไปที่ "ตัวแบบ + ฉาก" แล้วอธิบายใหม่
ใน OHLAC ผลลัพธ์ถูกเก็บไว้ในบัญชี คุณจึงกลับไปเวอร์ชันก่อนหน้าและทำต่อได้ ไม่ต้องเริ่มใหม่
สรุป
คำบรรยายภาพที่ดีขึ้นจริง ๆ คือการสั่งงานที่ชัดขึ้น: ตัวแบบและฉากก่อน แล้วสไตล์และรายละเอียด เปลี่ยนทีละตัวแปร สิ่งที่สำคัญไม่ใช่เทคนิคลับ แต่คือการบอกให้ชัดว่าคุณต้องการอะไร
ถ้าต้องการต่อยอดจากภาพที่มีอยู่ อ่าน ข้อควรระวังเมื่อใช้ภาพอ้างอิง เรื่องเครดิตดูที่ เครดิตและการเรียกเก็บเงิน