6.8 KiB
6.8 KiB
title
| title |
|---|
| 연대기 v0.1.0 |
-
입 (6월 8일)
- unspeech 프로젝트 생성 (12월 13일)
- TTS 연동 (6월 8일)
- 11Labs 연동
- unspeech 프로젝트 생성 (12월 13일)
-
청각 (12월 12일)
- 말하기 버튼 구현 (6월 9일)
오디오 전사프론트엔드에서 백엔드로 오디오 스트리밍- WebSocket 기반 양방향 통신을 위해 socket.io 사용 Socket.IO (6월 10일)
- Socket.io는 사실 WebSocket 기반이 아니다
- 프론트엔드는
socket.io-client패키지 사용,pnpm i socket.io-client- WebSocket은 지원이 좋고 Nuxt의 Nitro도 지원한다. How to use with Nuxt | Socket.IO
- 백엔드는
socket.io패키지 사용,pnpm i socket.io - Nuxt 3와 socket.io
오디오 스트리밍에 WebRTC 사용, VueUse도 이를 지원함- Nuxt와 Nitro가 아직 지원하지 않아 일단 보류. 그룹 채팅이나 Discord 용으로 검토해 볼 수 있음.
- 튜토리얼:
- WebSocket 기반 양방향 통신을 위해 socket.io 사용 Socket.IO (6월 10일)
Transformers.js + Whisper로 충분함- Chrome / Edge가 이제 WebGPU를 지원함
- 데모가 있음: Real-time Whisper WebGPU - a Hugging Face Space by Xenova (현재는 오픈소스가 아님)
Whisper 추론을 브라우저에서 바로 수행할 수 있음WebGPU가 아직 지원되지 않음(이제 지원됨)Node.js CPP Addon을 통해 Whisper.cpp를 임베딩하는 방안 검토- whisper.cpp
- Chrome / Edge가 이제 WebGPU를 지원함
- 튜토리얼:
- Whisper WebGPU 데모 (12월 10일)
- MicVAD 데모 (12월 11일)
- MicVAD + ONNX Whisper 실시간 전사 (12월 12일)
- dcrebbin/oai-voice-mode-chat-mac: Adds realtime chat for ChatGPT Voice Mode [Unofficial]
-
표정 (7월 9일)
-
다국어 지원
- UI 다국어 지원
-
UI 최적화
모델
- VRM
@pixiv/three-vrm을 알려 준 kwaa에게 감사드립니다- 관련 도구와 플러그인:
- 애니메이션 지원: VRM Animation
.vrma