Speakable

실시간 AI 맞춤형 영어 회화 앱 - 개인화된 대화 학습 프로토타입

방문하기
2024.02 - 2025.09
CTO & Co-founder
EnglishAI
hume-aigemininextjstailwind-cssvoice-interface

프로젝트 개요

학습자의 수준과 관심사에 맞춰 대화가 실시간으로 조정되는 영어 회화 프로토타입. EnglishAI에서 음성 중심 학습의 사용자 경험을 검증하기 위해 수행.

핵심 문제: 음성에서는 지연이 곧 경험이다

텍스트 채팅에서 2초는 무의미하지만, 음성 대화에서 2초는 ‘사람과 말하는 경험’과 ‘기계를 기다리는 경험’을 가른다. 일반적인 요청-응답 스택이 누적하는 지연을 음성은 허용하지 않으며, 학습자가 기다림을 체감하는 순간 자연스러운 발화를 멈춘다 — 제품이 유도하려는 바로 그 행동을.

따라서 이 프로토타입의 핵심 과제는 언어가 아닌 구조에 있었다. 무엇을 스트리밍할 것인가, 무엇을 사전 계산할 수 있는가, 모델 응답을 학습자의 발화 종료 이전에 시작할 수 있는 지점은 어디인가.

주요 역할 및 기여

  • 실시간 음성 대화 AI 시스템 프로토타이핑 — 체감 지연을 최우선 설계 제약으로 두고 전 구간 구성
  • Hume AI EVI 및 Gemini 2.5 Flash 통합 설계 — 표현력 있는 음성 계층과 빠른 추론 계층을 결합
  • 개인화된 대화 맥락 유지 구현 — 턴마다 초기화되지 않고 학습자의 수준·관심사가 대화 전반에 이어지도록 설계
  • 레벨 적응형 응답 생성 로직 개발 — AI가 어휘와 속도를 스스로 조절해 학습자보다 살짝 위의 난이도를 유지

기술 스택

  • AI: Hume AI SDK (EVI), Gemini 2.5 Flash
  • Frontend: Next.js, React, TypeScript
  • UI: Tailwind CSS
  • Infrastructure: Vercel (Serverless)