좀 혼란스럽네요, mimo-2.5 모델이 엄청나게 좋게 느껴져요
I am a bit confused, I am finding the mimo-2.5 model extremely good
핵심 요약
벤치마크 점수는 낮지만 사용하기 편하고 지시를 잘 따르는 Mimo 2.5 모델에 대한 사용자들의 긍정적인 경험 공유.
- 사용성 만족도 — 군더더기 없이 지시를 잘 따르고 사용하기 편함
- 캐시 유지력 — 긴 세션 동안 캐시를 유지해 작업 효율이 높음
- 워크플로우 활용 — 복잡한 작업은 고성능 모델로, 구현은 Mimo로 분담
- 한계점 존재 — 새로운 아이디어나 복잡한 작업에서는 오류가 발생함
좀 이상한 글일 수도 있는데, 그냥 어디다 털어놓고 싶어서 써봄. 딱히 질문이 있는 건 아님.
DeepSeek Flash 가격 오르고 나서 Mimo로 갈아탔는데, 이거 진짜 개좋음. 개쩐다 진짜. 제일 똑똑한 건 아님. 코딩할 때 실수도 좀 하고 퀄리티도 좀 떨어지는데, 쓰기가 너무 편함. 시키는 대로 잘하고, 말대꾸 안 하고, 이상한 짓도 안 함.
반면에 Codex Sol이랑 Terra는 진짜 개악몽임. 존나 '랜덤' 그 자체고, 지 맘대로 아무거나 지껄이고, 내가 시킨 건 다 씹음.
좀 혼란스럽네. 내가 뭘 잘못하고 있는 건가? 아니면 잘하고 있는 건가? 벤치마크 점수도 낮은 개싼마이 모델이 왜 나한테는 이렇게 잘 맞는 거지? 왜 벤치마크 점수 높고 대기업들이 다 쓴다는 프론티어 모델들은 하나같이 쓰레기 같은 거지?
한 가지 가설이 있음. 난 내 시스템 프롬프트랑 출력 방식 커스텀하는 걸 좋아하는데, 그게 ChatGPT 기본 시스템 프롬프트랑 충돌하는 거 아닐까? 걔네는 특정 방식으로만 행동하게 설계돼 있잖아. Mimo는 그런 프롬프트가 없는 건가? Opencode는 그런 설정을 안 해놓은 건가?
혹시 나랑 똑같이 느끼는 사람 있음?
참고로 Claude Opus 4.8도 괜찮았음. Codex는 진짜 최악이었고.

