IBM, 추론 특화 플래그십 모델 Granite-4.2-30B 공개
- IBM이 추론 특화 모델 Granite-4.2-30B를 공개했다.
- 내장 체인오브싱킹과 세 단계 사고 모드로 지연시간·정확도를 조절할 수 있다.
- 실제 성능 지표와 라이선스 조건은 원문 확인이 필요하다.
IBM은 Granite 4.2 패밀리의 최상위 모델로 Granite-4.2-30B를 Hugging Face에 공개했다. 이 모델은 <think>...</think> 형태의 내장 체인오브싱킹을 활용해 추론 집약적 과제에서 강점을 보이며, 전체 사고(full thinking), 비사고(non-thinking), 저강도 사고(low-effort) 등 세 가지 모드를 쿼리별로 선택할 수 있다.
체인오브싱킹은 모델이 답을 내기 전에 중간 추론 과정을 명시적으로 생성하도록 해 수학, 코딩, 다단계 문제 해결 성능을 높이는 기법으로, OpenAI의 o1 계열이나 DeepSeek-R1 이후 업계 전반에 확산된 접근이다. IBM은 기업용 신뢰성과 거버넌스를 강조해온 만큼, Granite 시리즈 역시 엔터프라이즈 환경에서의 활용을 염두에 둔 것으로 보인다.
실무에서는 지연시간과 정확도 사이의 트레이드오프를 애플리케이션별로 조정할 수 있다는 점이 유용하다. 예를 들어 실시간 응답이 필요한 챗봇에는 저강도 사고 모드를, 복잡한 코드 리뷰나 수치 검증이 필요한 백오피스 업무에는 전체 사고 모드를 적용하는 식으로 워크로드를 분리 설계할 수 있다.
모델의 실제 벤치마크 성능, 라이선스 조건, 상업적 이용 제한 여부는 발췌만으로는 확인되지 않아 원문 확인이 필요하다.
본문은 수집한 기사의 제목과 발췌를 바탕으로 AI가 정리한 해설입니다. 수치·날짜·조문 등 세부 사실은 원문에서 확인하세요.
IBMGranite-4.2-30B체인오브싱킹추론 모델
원문 출처
원문 읽기 Reddit r/LocalLLaMA