프로젝트 소개

이 저장소는 단계별 퀵스타트, 기능별 노트북, 실용적인 예제 애플리케이션을 통해 Gemini API에 대한 체계적인 학습 경로를 제공합니다. 가이드를 따르려면 Google 계정과 Google AI Studio의 API 키가 필요하며, 많은 노트북은 Google Colab에서 바로 열 수 있습니다. 퀵스타트 섹션은 인증, 기본 프롬프팅, 멀티모달 입력으로 시작하여 개별 API 기능으로 확장됩니다. 여기에는 저지연 음성 및 비디오 상호작용을 위한 멀티모달 Live API, 라이브 확장 사고, 라이브 오디오 스트림 번역, 단어 수준 타임스탬프, 화자 분리, 사용자 지정 어휘, 스마트 전사를 지원하는 오디오 파일 및 스트림용 Gemini Transcribe가 포함됩니다. 미디어 중심 가이드는 비디오 생성 및 편집을 위한 Omni Flash와 Veo, 이미지 생성을 위한 Imagen과 Nano-Banana, 음악 생성을 위한 Lyria, Lyria RealTime, 텍스트 음성 변환을 다룹니다. 그 밖에 문서화된 기능으로는 Google Search, Google Maps, YouTube, URL을 사용한 그라운딩, 사용자 데이터에 응답을 그라운딩하기 위한 호스팅 File Search, Python 코드 실행, Agents API와 관리형 Antigravity 에이전트, 시간에 민감하지 않은 워크로드를 위한 Batch API, 비동기 작업 알림을 위한 웹훅, Priority 및 Flex 추론 티어가 있습니다. 이 저장소에는 공간 이해와 추론을 위한 Gemini Robotics-ER 모델 가이드도 포함되어 있습니다. examples 디렉터리는 브라우저 자동화, 도서 일러스트레이션, 애니메이션 스토리 생성, 라이브 API 플로팅 및 매핑, 3D 공간 이해, API 비용 추정 및 상태 모니터링, Gradio를 사용한 Live API 인스턴스 배포와 같은 사용 사례에 여러 API 기능 또는 타사 도구를 결합합니다. 엔드투엔드 데모는 Gemini CLI, Flask API 퀵스타트, Multimodal Live API 웹 콘솔, 풀스택 LangGraph 퀵스타트, Google AI Studio 스타터 애플릿 등 별도의 저장소에 링크되어 있습니다. Gemini API는 curl을 사용한 REST API로 호출하거나 Python, Go, Node.js, Java, C#용 공식 SDK를 통해 호출할 수 있습니다. Enterprise Vertex AI 예제는 별도로 유지 관리되며, 기여 방법은 CONTRIBUTING.md에 문서화되어 있습니다.