khoe Midjourney-Tạo tranh ảnh bằng AI

  • Người tạo chủ đề Người tạo chủ đề DarkAngelTheLion
  • Ngày bắt đầu Ngày bắt đầu

DarkAngelTheLion

Senior Member
Mod Fioren:
Mọi người chú ý về việc ảnh 18+ nếu như ảnh chỉ hở hang, thì để ô spoiler kiểu để người khác lướt thread ko bị ngại khi ở nơi công cộng. Còn ảnh lộ bộ phận kín, ghê rợn, máu me, chỉ có súng, kiếm thì phải dẫn link ra hosting image khác vd imgur và đặt link trong ô code như vậy (nếu dùng mã hóa hex to text đc nữa thì càng tốt), thường google sẽ không quét link trong ô code

Mã:
Link
Mình cũng hay xem thread này nên thấy post nào không như vậy là mình sẽ xóa kèm thông báo nhé, mọi người thông cảm vì thread bị google warn là phải xóa hết thread chứ không phải chỉ xóa post là xong.

Không biết chủ đề này mở ở F17 có phù hợp không, nếu không phù hợp nhờ mod chuyển về nơi nào phù hợp hơn giúp mình. ok vào chủ đề

Chào anh em, mình lập topic này để giới thiệu với anh em về hệ thống tạo ảnh từ AI Midjourney

298552986_10101143972552466_5199271853519524040_n.jpg

Trước hết mình xin giới thiệu tổng quan về Midjourney
-Midjourney là một hệ thống nghiên cứu độc lập nhằm khám phá các phương thức tư duy mới và mở rộng khả năng tưởng tượng của con người
-Midjourney sử dụng hệ thống AI và một mạng lưới GPU để tạo ra những bức ảnh bằng nội dung người dùng cung cấp cho AI
-Nội dung cung cấp cho AI chỉ nhận diện bằng tiếng Anh (English) nên khi bạn muốn tạo một bức ảnh thì nên có kiến thức ngoại ngữ là cần thiết để giúp AI hiểu được thứ bạn muốn AI tạo ra cho bạn
-Nội dung cung cấp càng chi tiết, thì bức ảnh tạo ra càng chính xác và đẹp như bạn mong muốn
-Tuy nhiên AI không phải siêu nhân, bạn có thể phải tốn rất rất nhiều thời gian để có thể tạo ra 1 bức tranh ưng ý
-Hệ thống của Midjourney là một hệ thống phức tạp. AI hoạt động theo thuật toán và ma trận, nên nếu bạn có kiến thức về khoa học dữ liệu là một lợi thế lớn (mình cũng chả có kiến thức gì đâu, nên mới phải lập Group này để tìm kiếm thêm các bạn và hiểu về ngành này hỗ trợ thêm)
-AI của Midjourney sử dụng rất nhiều tập lệnh, mình sẽ cố gắng có các bài viết hoặc video cover nội dung các thông tin cơ bản nhất cho mọi người. Vậy bạn cần gì để tham gia vào Midjourney thì tóm lại các bạn cần những thứ đơn giản như sau
1- Tài Khoản Discord 2
- App Discord cài đặt vào máy
3- Tiền (nếu bạn nghiêm túc thực sự muốn trải nghiệm hệ thống của Midjourney một cách sâu rộng)
Bạn vào link để coi hướng dẫn tạo tài khoản tham gia Midjourney: https://docs.google.com/document/d/1QSFsJV1flQ5dEDy3hJmwdXaQ0wm8QbMUffI-aFqjhXU/edit?usp=sharing Hướng dẫn tạo ra bức tranh đầu tiên bằng AI của Midjourney: https://docs.google.com/document/d/1Rw3ITXIzEEnr5-XsyA3R5381rtMqlMQHRPgkIwO-XZw/edit?usp=sharing

Anh em có thể vào group FB mình có tạo để trao đổi về hệ thống này:
https://www.facebook.com/groups/1237756283656510
sau đây là vài hình mình tự nghiên cứu làm ra:
1.png
2.png
Fhantom_war_in_heaven_heavy_armor_space_ship_alien_dark_space_h_5425dbbc-e4d6-4f00-9410-f0e7d1...png
Fhantom_war_in_heaven_heavy_armor_space_ship_alien_dark_space_h_d3049507-2424-482b-972d-10cf14...png
Fhantom_sci-fi_war_knight_redy_for_thier_last_stand_ab87bbd0-4442-4885-b792-e02cdf1525f9.png
grid_0.png

Update
@DarkAngelTheLion Đã viết một cái hướng dẫn cho các đồng râm đây :shame:

Hướng dẫn cài Stable Diffusion để chạy trên PC (cho card Nvidia 4GB VRAM trở lên)

I. Các phiên bản UI phổ biến
1. AUTOMATIC1111 (Khuyên dùng)

Đây là bản Web UI gốc, nhiều tính năng nhất, nhanh nhất.
Link github: https://github.com/AUTOMATIC1111/stable-diffusion-webui
Link tải trực tiếp: https://github.com/AUTOMATIC1111/stable-diffusion-webui/archive/refs/heads/master.zip
2. hlky
Bản này không nhiều tính năng như bản gốc nhưng khá phổ biến.
Link github: https://github.com/hlky/stable-diffusion-webui
3. neonsecret
Bản siêu tối ưu, dùng ít VRAM nhất, nhưng cũng chậm nhất trong các bản. Dành cho ai muốn tạo ảnh với độ phân giải cao hơn các bản trên.
Link github: https://github.com/neonsecret/stable-diffusion

II. Hướng dẫn cài đặt (bản của AUTOMATIC1111)
1. Tải model

Tải model.ckpt từ trang chủ (phải đăng ký tài khoản): https://huggingface.co/CompVis/stable-diffusion-v-1-4-original
hoặc
Tải từ link Google Drive mình up: https://drive.google.com/file/d/1e5W3M9feF-mUZiI3ovLq1J9YfhvX6zgX/view?usp=sharing

(Tùy chọn) Tải GFPGANv1.3.pth dùng để chỉnh sửa mặt mũi cho đẹp: https://github.com/TencentARC/GFPGAN/releases/download/v1.3.0/GFPGANv1.3.pth
Dùng sẽ tốn VRAM và thời gian tạo ảnh.
2. Cài đặt
  • Cài Python 3.10.6, nhớ chọn "Add Python to PATH" khi cài đặt.
  • Cài git
  • Cài CUDA 11.3
  • Copy file model.ckpt vào thư mục webui.
  • (Tùy chọn) Copy file GFPGANv1.3.pth vào thư mục webui.
  • Chạy webui.bat và chờ sau khi cài xong thì vào link http://127.0.0.1:7860/ để dùng.
913OXZU.jpg


3. Tối ưu VRAM (Dành cho card 4GB hoặc cho ai muốn tăng độ phân giải ảnh)
Trước khi chạy thì mở file webui.bat lên bằng notepad rồi thêm lệnh sau vào dòng 5 để tối ưu VRAM:
--medvram --opt-split-attention : Tối ưu VRAM ở mức trung bình mà không mất nhiều tốc độ.
--lowvram --always-batch-cond-uncond --opt-split-attention : Tối ưu VRAM nhất, nhưng rất chậm.

IvVz0Go.jpg


III. Hướng dẫn sử dụng
1. txt2img
a. Giao diện

Giao diện của Web UI khá dễ dùng, chỉ cần gõ Promt xong bấm nút Generate rồi chờ là tạo được ảnh.
  • Prompt: Phần miêu tả bức tranh cần tạo.
  • Sampling Steps: Thấp nhất cần để tạo một bức ảnh có thể nhìn qua sơ sơ là 8 steps, hoàn chỉnh phải cần 50 steps trở lên.
  • Sampling Method: Phổ biến nhất là LMS (50 steps), nhanh nhất? là DDIM (8-16 steps), và sáng tạo nhất là Eular a (8-16 steps). Cá nhân mình thấy Eular cũng khá ổn.
  • Tiling: Tạo ảnh dạng pattern có thể lặp đi lặp lại, như hoa văn trên sàn nhà.
  • Batch count: Số lần tạo ảnh (khi dùng random seed -1), VD: Ảnh đầu random ra Seed là 1234 thì ảnh sau sẽ có Seed là 1235.
  • Batch size: Số ảnh tạo trong một lần.
VD: Batch count: 3 + Batch size: 2 => AI sẽ tạo 2 ảnh, rồi 2 ảnh, rồi 2 ảnh = 6 ảnh là hoàn tất công việc. (Cần nhiều VRAM hơn)
Nếu muốn tạo 2 ảnh thì Batch size 2 sẽ nhanh hơn Batch count 2.
- CFG Scale: Độ sáng tạo của AI dựa trên Prompt.
1-6: Rất ngẫu hứng.
7-11: Dựa theo Prompt.
12-15: Theo rất sát Prompt.
  • Height x Width: Chiều cao x Chiều ngang. (Hơi ngược)
  • Seed: Mỗi seed khác nhau sẽ tạo ra các véc-tơ ảnh khác nhau. Mặc định là -1 (random)
  • Script: Tạo ra ảnh dạng grid, 2x2, 3x3,...

LAcjmOk.jpg


b. Prompt

Để tạo được một bức ảnh đẹp thì cần nhiều keywords khác nhau.
Thông thường một Prompt sẽ gồm: (Đối tượng cần vẽ), (Chất liệu), (Màu sắc), (Hiệu ứng), (Phong cách vẽ), (Họa sĩ)

VD: Nếu đổi từ Skeleton -> Cybernetic, Wolf -> Deer thì sẽ được một bức như sau.
2m5avGc.jpg


Phần tô đỏ có thể hiểu nôm na là vector hay pose của ảnh (còn chính xác là gì thì mình không rõ), cái này phụ thuộc vào Seed và Độ phân giải của ảnh.
Nên chọn Seed có pose đẹp để tạo, đừng chọn các Seed bị quá lệch khỏi khung.

Nếu vẽ tranh Chân dung (Portrait) thì nên dùng Độ phân giải có Chiều cao > Chiều rộng.
Nếu vẽ tranh Phong cảnh (Landscape) thì nên dùng Độ phân giải có Chiều rộng > Chiều cao.

c. Keywords
Các keywords phổ biến: cinematic lighting, highly detailed, intricate, shiny, digital painting, artstation, concept art, smooth, sharp focus, illustration,...

Tham khảo thêm: (Chú ý có thể có ảnh 18+)
https://github.com/Maks-s/sd-akashic
https://lexica.art/
https://libraire.ai/
https://www.krea.ai/

2. img2img
-Redraw: Vẽ lại toàn bộ tranh dựa trên pose của tranh gốc.
-Inpaint: Dùng để vẽ đè lên tranh gốc, như deepfake :sexy_girl:
-Outpaint: Mở rộng tranh gốc sang các phía khác nhau. (Trong phần Script)
-Loopback: Cũng là vẽ lại tranh nhưng sẽ giống tranh gốc hơn là Redraw.

VD: Nếu muốn anh Gigachad có một bộ giáp sắt ngầu như trái bầu chẳng hạn thì dùng Inpaint để tô lên xong tạo ảnh mới.
(Phần Steps của UI có thể hơi lỗi, 66 steps nhưng thực ra chỉ có 50 steps trong log thôi)
NJqoXhZ.jpg

update.............

update tut chạy GGcolab
Hướng dẫn run Stable Diffusion trên Google Colab dành cho bạn nào muốn mì ăn liền

Build trên Google Colab, lợi ích là tiện và tận dụng được sức mạnh hàng của Google, quan trọng nhất là không cần down về máy setup gì hết. Khi bạn tắt Colab thì server sẽ down, hoặc bạn phải di chuyển tương tác trên colab 1 tí (mình nhớ không nhầm thì sau 30p-1 tiếng inactive sẽ shutdown)
L5y4i7p.png
.


Bản của mình đã update V1.1: https://colab.research.google.com/g...2c4a59/v1-1-stablediffusionui-voldemort.ipynb

Gốc của bạn AUTOMATIC1111: Tham khảo

1. Nhớ chọn Copy To Drive để thành file riêng của các bạn trước khi chạy
Lưu ý quan trọng: Edit/Notebook settings để mở Hardware Accelerator là GPU. TPU thì mình chưa test.
Xem tệp đính kèm 1366988

2. Sau đó cứ Shift + Enter hoặc nhấn nút Play ở từng block.
3. Nếu bạn gặp phải bị crash thì hãy chạy block kế tiếp, việc crash này là để flush memory để process nó nhẹ đi, không ảnh hưởng session đang chạy
4. Ra tới hàng cuối cùng thì thấy link xxx.gradio.app như hình dưới này là thành công

Xem tệp đính kèm 1366990


Note:
  • Link gradio sẽ là một proxy connect từ Colab đến internet, nghĩa là bạn có thể access ở mọi nơi, tuy nhiên hạn chế là nếu nhiều hơn 72 tiếng thì proxy này sẽ bị expire
  • Google Colab là hàng xịn của Google, dùng account Google và tính toán dựa trên Resource của Google cấp cho trong mỗi Session tối đa 8 tiếng.
  • Mỗi session sẽ cho một lượng Disk và RAM khá dồi dào, Disk có thể dư được tầm 50GB và RAM là 16GB, chưa kể GPU tích hợp khá xịn nữa, sẽ randomly assigned GPU Tesla K80 12GB hoặc xịn sò hơn như P100.
  • Đặc biệt Colab còn cho TPU, là một Tensor GPU của Google chuyên để chạy ML, tuy nhiên code phải tối ưu từ GPU-TPU cũng khá mệt chứ không dễ, mình chưa nghiên cứu xem code nó đã move qua chưa :doubt:
  • Nếu muốn terminate session để hoàn toàn như mới, thì vào Runtime/Manage Session để kill nó, lúc này các file đã download sẽ bị mất.
  • Nếu bạn có dàn GPU xịn sò, thì có thể chạy Jupyter Notebook (là cái notebook mà Colab đang xài) trên máy của bạn, mình sẽ viết 1 tut khác cho cái này
Thay đổi phong cách tranh với Textual Inversion

I. Textual Inversion

Textual Inversion là gì? Hiểu đơn giản là một cách để dạy AI vẽ theo ảnh mẫu có sẵn mà không cần thay đổi model.
  • File rất nhẹ. (dưới 10KB)
  • Có thể dùng với nhiều model khác nhau.
  • Có thể tự dạy AI bằng VGA dân dụng.

II. Cài đặt (Với bản AUTOMATIC1111)
Làm mẫu với file Textual Inversion được train với ảnh của họa sĩ Hiten: https://huggingface.co/datasets/BumblingOrange/Hanks_Embeddings/blob/main/Hiten-10k.pt
  • Bước 1: Tạo thư mục "embeddings" trong thư mục gốc của SD (có chứa file webui.py)
  • Bước 2: Copy file .pt hoặc .bin vào thư mục embeddings (Không cần khởi động lại SD)
  • Bước 3: Thêm từ khóa vào Prompt để sử dụng. VD đối với file trên: <Hiten-10k>

III. Thử nghiệm
  • Thử nghiệm với Prompt: anime girl, intricate game_cg, trending on pixiv, by (((artgerm and wlop and greg rutkowski))) and [Thomas Kinkade], intricate vibrant colors, from_above
  • Thêm từ khóa vào đầu hoặc cuối Prompt: <Hiten-10k> as anime girl, intricate game_cg, trending on pixiv, by (((artgerm and wlop and greg rutkowski))) and [Thomas Kinkade], intricate vibrant colors, from_above
  • Dùng Eular_a với 20 steps.
  • Hình trên và dưới cùng một Seed.
  • Đối với img2img: Denoising strength để ở 0.6
Kết quả như hình.

ukvpmps.jpg


IV. Train AI
  • Có thể dạy cho AI học theo Style (Phong cách vẽ) hoặc Object (Người, đồ vật). Nhưng thường thì sẽ chỉ dùng Textual Inversion để dạy style thôi, còn object thì nên dùng cái khác (Dreambooth).
  • Chuẩn bị: Nhiều ảnh mẫu, số lượng tùy theo steps định train.
  • Sử dụng Google Collab để train AI: (Miễn phí)
https://colab.research.google.com/g...diffusers/sd_textual_inversion_training.ipynb
- Lưu ý:
Train 3000 steps sẽ tốn khoảng 3 tiếng trên Google Collab.
Nhưng nếu muốn ảnh nuột như hình minh họa thì phải train tầm 10000 steps mới ổn.
Muốn nhanh thì chỉ có dùng hoặc bỏ tiền thuê VGA xịn. (1~2$/giờ)
Hướng dẫn cài xformers để tăng tốc độ tạo ảnh
(cho GPU 1xxx 2xxx. Còn 3xxx thì không cần tốn thời gian cài, thêm lệnh chạy thẳng luôn)
https://github.com/AUTOMATIC1111/stable-diffusion-webui/wiki/Xformers


  • Mở cmd
  • cd /d Đường dẫn đến thư mục SD
  • venv\Scripts\activate.bat
  • cd repositories
  • git clone https://github.com/facebookresearch/xformers.git
  • cd xformers
  • git submodule update --init --recursive
  • git config --system core.longpaths true
  • pip install --upgrade setuptools
  • pip install -r requirements.txt
  • pip install -e .
  • Chờ dưới 1 tiếng để cài xong. Thêm lệnh --force-enable-xformers vào COMMANDLINE_ARGS để chạy.

Có thể thử nếu lỗi:
  • pip install setuptools==49.6.0
  • Đổi cmd khác.
update post 1 :love:
 
Sửa lần cuối bởi điều hành viên:
Không biết chủ đề này mở ở F17 có phù hợp không, nếu không phù hợp nhờ mod chuyển về nơi nào phù hợp hơn giúp mình. ok vào chủ đề

Chào mừng anh em, mình lập topic này để giới thiệu với anh em về hệ thống tạo ảnh từ AI Midjourney

Xem tệp đính kèm 1315650
Trước hết mình xin giới thiệu tổng quan về Midjourney -Midjourney là một hệ thống nghiên cứu độc lập nhằm khám phá các phương thức tư duy mới và mở rộng khả năng tưởng tượng của con người
-Midjourney sử dụng hệ thống AI và một mạng lưới GPU để tạo ra những bức ảnh bằng nội dung người dùng cung cấp cho AI -Nội dung cung cấp cho AI chỉ nhận diện bằng tiếng Anh (English) nên khi bạn muốn tạo một bức ảnh thì nên có kiến thức ngoại ngữ là cần thiết để giúp AI hiểu được thứ bạn muốn AI tạo ra cho bạn -Nội dung cung cấp càng chi tiết, thì bức ảnh tạo ra càng chính xác và đẹp như bạn mong muốn
-Tuy nhiên AI không phải siêu nhân, bạn có thể phải tốn rất rất nhiều thời gian để có thể tạo ra 1 bức tranh ưng ý
-Hệ thống của Midjourney là một hệ thống phức tạp. AI hoạt động theo thuật toán và ma trận, nên nếu bạn có kiến thức về khoa học dữ liệu là một lợi thế lớn (mình cũng chả có kiến thức gì đâu, nên mới phải lập Group này để tìm kiếm thêm các bạn và hiểu về ngành này hỗ trợ thêm)
-AI của Midjourney sử dụng rất nhiều tập lệnh, mình sẽ cố gắng có các bài viết hoặc video cover nội dung các thông tin cơ bản nhất cho mọi người. Vậy bạn cần gì để tham gia vào Midjourney thì tóm lại các bạn cần những thứ đơn giản như sau
1- Tài Khoản Discord 2
- App Discord cài đặt vào máy
3- Tiền (nếu bạn nghiêm túc thực sự muốn trải nghiệm hệ thống của Midjourney một cách sâu rộng)
Bạn vào link để coi hướng dẫn tạo tài khoản tham gia Midjourney: https://docs.google.com/document/d/1QSFsJV1flQ5dEDy3hJmwdXaQ0wm8QbMUffI-aFqjhXU/edit?usp=sharing Hướng dẫn tạo ra bức tranh đầu tiên bằng AI của Midjourney: https://docs.google.com/document/d/1Rw3ITXIzEEnr5-XsyA3R5381rtMqlMQHRPgkIwO-XZw/edit?usp=sharing

Anh em có thể vào group FB mình có tạo để trao đổi về hệ thống này:
https://www.facebook.com/groups/1237756283656510
sau đây là vài hình mình tự nghiên cứu làm ra:
Xem tệp đính kèm 1315651
nhìn chất thế này ko biết tự vẽ truyện tranh bằng cái này được hơm? hay vẽ pỏn cho thực tế chả hạn. bầu trời kim loại, đất thì đầy xác chết, vũng nước xa xa là hóa chất, còn nằm ở trung tâm bức ảnh là 1 em tương tự nancy đang thẩm du chả hạn :shame: :hungry:
 
Sửa lần cuối:
nhìn chất thế này ko biết tự vẽ truyện tranh bằng cái này được hơm? hay vẽ pỏn cho thực tế chả hạn. bầu trời kim loại, đất thì đầy xác chết, vũng nước xa xa là hóa chất, còn nằm ở chung tâm bức ảnh là 1 em tương tự nancy đang thẩm du chả hạn :shame: :hungry:
hệ thống Ban nội dung PG18 rùi, nên đừng mơ anh em ạ :D
 
hay phết nhưng có vẻ nó không vẽ được cảnh chiến đấu kiểu hai đối tượng chiến đấu với nhau. Nó toàn nhập hai đối tượng thành một
 

Thống kê chủ đề

Ngày tạo
DarkAngelTheLion,
Người trả lời cuối
traithanhnam90,
Trả lời
2.072
Lượt xem
297.316
Quay lại
Lên đầu trang