Gemini는 세계 최고의 AI가 되어야 합니다. 구글은 모든 유리한 조건을 갖췄는데, 왜 여전히 베타 제품처럼 느껴질까요?
Gemini should be the best AI on earth. Google has every advantage possible. So why does it keep feeling like a beta product?
핵심 요약
구글의 방대한 자원에도 불구하고 Gemini가 신뢰성 부족, 일관성 없는 답변, 환각 현상 등으로 베타 제품처럼 느껴진다는 비판입니다.
- 신뢰성 문제 — 근거 없는 정보를 자신 있게 제시하며 환각 현상을 보임
- 일관성 부족 — 질문 방식에 따라 답변의 깊이와 형식이 매번 달라짐
- 검색 통합 실패 — 실시간 정보 접근 기능이 있으나 정보 합성 능력이 낮음
- 제품 전략 비판 — 핵심 모델 완성보다 기존 제품에 끼워 넣기에 급급함
제미나이(Gemini)를 좋아하고 싶다. 진짜로. 구글은 검색, 유튜브, 지메일, 드라이브, 딥마인드까지 다 가지고 있고, 수십 년간 쌓아온 NLP 연구 데이터에 웬만한 국가보다 많은 컴퓨팅 자원까지 쏟아붓고 있잖아. 스펙만 보면 다른 AI가 구글을 이길 이유가 전혀 없는데, 현실은 이 모양이지.
제일 빡치는 건 얘가 틀린 답을 내놓는다는 게 아님. 모든 모델이 다 틀리니까. 진짜 문제는 제미나이가 틀린 정보를 마치 토론에서 이기기라도 한 것처럼 아주 자신만만하게, 심지어 출처까지 달아가며 떠든다는 거야. 구닥다리 정보랑 최신 검색 결과를 섞어놓고는 전부 다 똑같이 확실한 정보인 양 포장하는데, 이걸 믿는 사람들한테는 진짜 위험한 수준임.
성격 문제도 심각함. 제미나이는 일관성이 없음. 간단한 걸 물어보면 깔끔하게 리스트로 정리해주다가, 똑같은 질문을 말투만 좀 바꿔서 다시 물어보면 답변 깊이가 완전히 달라짐. 사용자가 어떻게 글을 쓰는지 그 겉핥기식 패턴에만 반응할 뿐, 정작 내가 뭘 원하는지는 제대로 이해 못 하는 느낌임. 도대체 어떤 버전의 제미나이가 튀어나올지 종잡을 수가 없음.
구글 검색 연동은 원래 킬러 기능이어야 함. 다른 모델들은 지식 컷오프에 갇혀 있을 때 실시간 정보에 접근한다는 건 진짜 엄청난 장점이니까. 근데 막상 써보면 모델이 검색 좀 하다가 상위 결과 두 개 대충 훑어보고 나머지는 그냥 지 맘대로 지어내는 느낌임. 출처는 들쭉날쭉하고 정보 통합 수준은 얕기 그지없음.
다단계 추론 작업할 때도 이 급의 모델이라고는 믿기 힘들 정도로 맥락을 놓치는 경우가 많음. 1단계, 2단계는 잘하다가 중간 어디선가 갑자기 딴소리를 하더니, 방금 자기가 세운 전제랑은 전혀 상관없는 결론을 내놓음. 근데 그 과정에서 조금이라도 헷갈려하는 기색조차 없음.
제품 전체가 실사용에서의 신뢰성보다는 데모 영상에서 멋있어 보이는 데만 최적화된 느낌임. 쇼룸에 전시된 차처럼 번지르르하기만 하지, 정작 중요한 일을 맡기기엔 도저히 믿음이 안 감.
나만 이렇게 느끼는 건지, 아니면 내가 잘못 쓰고 있는 건지 궁금함. 혹시 내가 틀린 거라면 기꺼이 지적받을 의향 있음.

