구글, 가장 빠르고 저렴한 AI 모델 Gemini 2.5 Flash-Lite 출시

Investing.com — 구글이 Gemini 2.5 Flash-Lite의 안정 버전을 출시하여 프로덕션 환경에서 사용할 수 있는 2.5 모델 라인업을 완성했다. 새로운 모델은 번역 및 분류와 같이 지연 시간에 민감한 작업에서 품질을 유지하면서 성능과 비용의 균형을 맞추도록 설계되었다.
Gemini 2.5 Flash-Lite는 광범위한 프롬프트에서 이전 2.0 Flash-Lite 및 2.0 Flash 모델보다 낮은 지연 시간을 제공한다. 가격은 백만 입력 토큰당 $0.10, 백만 출력 토큰당 $0.40으로, 구글의 가장 저렴한 2.5 모델이다. 또한 오디오 입력 가격은 미리보기 출시 이후 40% 인하되었다.
비용 효율성에도 불구하고 이 모델은 코딩, 수학, 과학, 추론 및 멀티모달 이해를 포함한 벤치마크에서 2.0 Flash-Lite보다 더 높은 품질을 보여준다. 사용자는 1백만 토큰 컨텍스트 창, 제어 가능한 사고 예산, 구글 검색을 통한 그라운딩, 코드 실행 및 URL 컨텍스트와 같은 기본 도구를 지원받을 수 있다.
여러 회사가 이미 새로운 모델을 구현했다. 분산형 우주 컴퓨팅 플랫폼인 Satlyt는 중요한 온보드 진단에서 45%의 지연 시간 감소와 30%의 전력 소비 감소를 경험했다. HeyGen은 이 모델을 사용하여 비디오 계획을 자동화하고 비디오를 180개 이상의 언어로 번역한다. DocsHound는 이를 활용하여 긴 비디오를 처리하고 낮은 지연 시간으로 스크린샷을 추출하는 반면, Evertune은 AI 모델에서 브랜드가 어떻게 표현되는지 분석하는 데 사용한다.
개발자는 코드에서 "gemini-2.5-flash-lite"를 지정하여 Gemini 2.5 Flash-Lite 사용을 시작할 수 있다. 구글은 2025년 8월 25일에 미리보기 별칭을 제거할 계획이다. 이 모델은 구글 AI Studio 및 버텍스 AI에서 사용할 수 있다.
이 기사는 인공지능의 도움을 받아 번역됐습니다. 자세한 내용은 이용약관을 참조하시기 바랍니다.
-
등록일 08.17
-
등록일 08.15
-
등록일 08.15
-
등록일 08.15





