지식 피드로 돌아가기
뉴스기술·AI

구글 Gemini 3.8 Flash, 추론 단계 늘리고 도구 반복 호출로 성능 강화

원문 보기 · The Verge

구글이 전작 출시 몇 주 만에 Gemini 3.8 Flash를 공개했으며, 복잡한 작업에서 추론 단계를 늘리고 도구를 반복 호출하는 방식으로 성능을 강화했다고 밝혔다. 가격은 3.7 Flash와 동일하지만 토큰 사용량 증가로 실제 비용은 늘어날 수 있다.

구글은 Gemini 3.8 Flash를 출시하면서 전작인 3.7 Flash보다 복잡한 작업에서 더 많은 추론 단계를 수행하고 도구를 반복적으로 호출해 '더 열심히 작동한다'고 설명했다. 입력 토큰 기준 100만 개당 0.75달러, 출력 토큰 기준 100만 개당 3.75달러로 3.7 Flash와 동일한 초기 가격 정책을 유지한다.

최근 주요 AI 기업들은 짧은 주기로 후속 모델을 출시하며 추론 능력과 도구 호출(tool use) 성능을 경쟁적으로 강화하는 흐름을 보이고 있다. 가격을 동일하게 유지하면서 성능 향상을 내세우는 방식은 API 기반 서비스에서 흔히 쓰이는 마케팅 전략이기도 하다.

AI 모델을 API로 연동해 서비스나 업무 자동화를 운영하는 개발팀은 동일 가격이라도 '노력 수준(effort level)'이 높아지면 토큰 소비량이 늘어 실제 청구 비용이 증가할 수 있다는 점을 점검할 필요가 있다. 비용 관리가 중요한 경우 기존 3.7 Flash를 유지하는 선택지도 함께 검토할 필요가 있다.

실제 벤치마크 성능 향상 폭이나 어떤 작업 유형에서 효과가 큰지는 발췌만으로는 확인되지 않아 공식 문서나 벤치마크 결과 확인이 필요하다.

본문은 수집한 기사의 제목과 발췌를 바탕으로 AI가 정리한 해설입니다. 원문 전체를 옮긴 것이 아니므로 수치·날짜·조문 등 세부 사실은 위 원문 링크에서 확인하세요. 개별 사안에 대한 법률·세무·노무·회계·의료 자문을 대체하지 않습니다.

관련 강의

기술·AI 실무를 강의로 이어서 학습하세요

읽은 주제를 실무 절차로 옮기는 과정은 전문가 강의에서 다룹니다. 분야별 커리큘럼과 수강 현황을 강의 페이지에서 확인할 수 있습니다.

강의 보러 가기