Speakable
실시간 AI 맞춤형 영어 회화 앱 - 개인화된 대화 학습 프로토타입
2024.02 - 2025.09
CTO & Co-founder
EnglishAI
hume-aigemininextjstailwind-cssvoice-interface
프로젝트 개요
학습자의 수준과 관심사에 맞춰 대화가 실시간으로 조정되는 영어 회화 프로토타입. EnglishAI에서 음성 중심 학습의 사용자 경험을 검증하기 위해 수행.
핵심 문제: 음성에서는 지연이 곧 경험이다
텍스트 채팅에서 2초는 무의미하지만, 음성 대화에서 2초는 ‘사람과 말하는 경험’과 ‘기계를 기다리는 경험’을 가른다. 일반적인 요청-응답 스택이 누적하는 지연을 음성은 허용하지 않으며, 학습자가 기다림을 체감하는 순간 자연스러운 발화를 멈춘다 — 제품이 유도하려는 바로 그 행동을.
따라서 이 프로토타입의 핵심 과제는 언어가 아닌 구조에 있었다. 무엇을 스트리밍할 것인가, 무엇을 사전 계산할 수 있는가, 모델 응답을 학습자의 발화 종료 이전에 시작할 수 있는 지점은 어디인가.
주요 역할 및 기여
- 실시간 음성 대화 AI 시스템 프로토타이핑 — 체감 지연을 최우선 설계 제약으로 두고 전 구간 구성
- Hume AI EVI 및 Gemini 2.5 Flash 통합 설계 — 표현력 있는 음성 계층과 빠른 추론 계층을 결합
- 개인화된 대화 맥락 유지 구현 — 턴마다 초기화되지 않고 학습자의 수준·관심사가 대화 전반에 이어지도록 설계
- 레벨 적응형 응답 생성 로직 개발 — AI가 어휘와 속도를 스스로 조절해 학습자보다 살짝 위의 난이도를 유지
기술 스택
- AI: Hume AI SDK (EVI), Gemini 2.5 Flash
- Frontend: Next.js, React, TypeScript
- UI: Tailwind CSS
- Infrastructure: Vercel (Serverless)