Gemini 3.5 체크포인트에 대한 추가 정보 (테스트에서 Opus 5 max thinking을 이김)
One more thing about Gemini 3.5's checkpoint (Beat Opus 5 max thinking in a test)
핵심 요약
Gemini 3.5 Pro의 성능 테스트 결과와 Deep Think 기능의 유료화 여부를 둘러싼 사용자들의 논쟁.
- 성능 테스트 — Gemini 3.5 Pro가 Opus 5와 Qwen 3.7을 상대로 일부 오류가 있었으나 전반적으로 우수한 결과물을 보여줌.
- Deep Think 기능 — Pro 및 무료 사용자에게도 Deep Think 기능이 제공될지 여부에 대해 사용자들 사이에서 의견이 갈림.
- 플랫폼 경제 논쟁 — 무료 사용자의 컴퓨팅 자원 점유와 유료 구독자의 혜택 범위를 두고 사용자 간 입장 충돌 발생.
- 사용자 피드백 — 영상의 렉 문제와 Google AI Studio를 통한 Deep Research 활용 팁 등이 공유됨.
Gemini 3.5 Pro가 이번 테스트에서 Opus 5 max thinking을 이겼음: (Opus가 저지른 실수: 타겟팅 시스템이 글리치됨. 공정하게 말하자면 Gemini도 똑같이 망쳤음. 또 다른 실수는 지구가 원과 제대로 동기화되지 않은 것. 그리고 몇 가지 더 있음)
Gemini가 더 나은 텍스처를 만들었지만 몇 가지 실수도 있었음. 박빙이라고 생각하지만 여기서는 Gemini가 이겼다고 봄.
또 다른 점; 3.5 Pro에는 Deep Think 모드가 있다는 이야기가 있음 (Ultra 구독자가 가진 Deep Think와는 다름!?), 내가 확신하건대 대부분의 체크포인트는 Deep Think가 활성화되지 않았고 아마 'High' 옵션이었을 거임. 그래서 우리는 Gemini의 최고 성능을 보고 있는 게 아님. Deep Think가 Pro/무료 사용자에게도 제공되길 바람.
https://streamable.com/00p0sm 다른 테스트 영상임. Qwen 3.7과 맞붙었음.
Gemini 3.5 Pro의 결과는 놀랍지만, 한 가지 실수를 저질렀는데 바로 사지를 반전시킨 거임. 수정하는 데 오래 걸리지는 않겠지만 (그렇게 큰 실수는 아님, 그냥 축을 잘못 잡은 거임).
나는 여전히 Qwen 3.7의 손을 들어주고 싶은데, Gemini 3.5 Pro와 달리 로봇의 물리적 구현이 괜찮았기 때문임.
Gemini의 다른 모든 품질은 놀랍고 더 낫다고 생각함. Jump 같은 기능도 그렇고 (Qwen 3는 꽤 밋밋함). Qwen 3.7은 실수를 많이 했지만 치명적인 실수는 아니었음. 반면 Gemini 3.5 Pro는 치명적인 실수를 하나 했지만 쉽게 고칠 수 있는 수준임.
Gemini 3.5 Pro의 로봇은 디테일 면에서 정말 놀라웠음.
(비교를 위해 Gemini 3.1 Pro가 어떻게 생겼는지 보여줌)
또 다른 점; 3.5 Pro에는 Deep Think 모드가 있다는 이야기가 있음 (Ultra 구독자가 가진 Deep Think와는 다름!?), 내가 확신하건대 대부분의 체크포인트는 Deep Think가 활성화되지 않았고 아마 'High' 옵션이었을 거임. 그래서 우리는 Gemini의 최고 성능을 보고 있는 게 아님. Deep Think가 Pro/무료 사용자에게도 제공되길 바람.
아마 3.5 Pro는 Deep Think Mini가 될지도.
영상 렉에 대해서는 사과함. 내 PC가 좋지 않음. 영상이 뒤로 갈수록 나아짐.



