MODEL COMPARISON / 90 PAIRED SAMPLES

So sánh bằng hình.
Không bằng cảm giác.

Mỗi hàng là cùng một prompt, chấm trên cùng năm tiêu chí. Chọn phong cách để xem chênh lệch và đọc output ở kích thước lớn.

TOÀN BỘ BỘ MẪU

Điểm trung bình

Đây là phép đo trên bộ 90 prompt này, không phải tuyên bố chất lượng tuyệt đối của model.

ChatGPT9.3675 thắng
Gemini8.622 thắng
13kết quả hòa
trong biên độ 0,25

Lai phong cách / 088

Cyberpunk + Ukiyo-e + Glitch Art

Xem prompt đầy đủ
Cyberpunk + Ukiyo-e + Glitch Art: kết quả ChatGPT.
CHATGPT9.40
Cyberpunk + Ukiyo-e + Glitch Art: kết quả Gemini.
GEMINI / GFLOW-CLI7.80

NHẬN XÉT

ChatGPT nhỉnh hơn

OpenAI hòa trộn đủ cyberpunk, ukiyo-e và glitch; GFlow thêm nhiều chữ giả, glitch yếu.

Tiêu chíChatGPTGemini
Bám prompt10.010.0
Đúng phong cách10.08.0
Bố cục10.08.0
Kỹ thuật9.08.0
Chi tiết / artifact8.05.0

Cách đọc: điểm 1–10 do cùng một quy trình đánh giá có cấu trúc. Chênh lệch nhỏ hơn 0,25 được xem là hòa.

Xem phương pháp và giới hạn