새로운 벤치마크가 나왔습니다!
New benchmark just dropped!
핵심 요약
AI 모델의 프롬프트 이해력을 테스트하기 위해 기괴한 상황을 생성하는 새로운 벤치마크가 공유되었습니다.
- 벤치마크 테스트 — 기괴한 상황을 프롬프트로 입력해 모델의 이미지 생성 능력을 비교함.
- 모델 성능 비교 — Qwen, Gemini 등 다양한 모델의 프롬프트 이행력을 테스트함.
- 오타 영향 — 프롬프트 내 오타가 모델의 결과물에 미치는 영향에 대해 토론함.
자전거 타는 펠리컨은 이제 너무 구식이라, 새롭고 개선된 버전을 가져왔다.
Qwen3.8-27b medium (UD-Q4_K_XL) vs. Sol 5.6 high vs. Qwen3.6-35B (UD-Q6_K_XL)
프롬프트 (오타까지 그대로!):
"Create a svg of a horse on a blue bycicle in the desert, with a camel in the background."

