Qwen3-TTS와 faster-whisper로 로컬 음성 복제 구성
로컬 음성 복제를 구성하며 GPT-SoVITS의 호환성 문제를 확인하고 Qwen3-TTS로 전환한 과정을 정리했다.
로컬 음성 복제를 구성하며 GPT-SoVITS의 호환성 문제를 확인하고 Qwen3-TTS로 전환한 과정을 정리했다.
출판사 CSS를 유지하는 EPUB 리더를 직접 만들었다. WebView의 same-origin 제약을 해결하는 데 가장 많은 시간이 들었다.
MineRL env.reset() 실패를 stale PID 파일 정리로 해결한 과정을 정리했다.
홈서버 서비스 장애를 놓치지 않도록 Uptime Kuma와 ntfy로 폰 알림을 구성했다.
사내 AI Masters 활동과 통합 MCP 서버의 전사 확산 과정을 정리했다.
사내 Atlassian을 MCP로 열면서 사용자별 권한을 그대로 지키는 전사 모델을 설계했다.
Gemma 4B LoRA 학습을 구형 GPU 두 장에 분산하고 데이터 정제와 평가 결과를 확인했다.
피카츄 배구를 PPO로 학습시켰는데 승률이 28%에서 멈춰 보상 설계를 다시 봤다.
SmolLM2 135M과 Llama 3.2 3B를 실행해 기본 응답 품질을 확인한 기록이다.
MCP 서버의 쓰기·읽기 도구 한도를 부하 테스트로 측정하며 만난 nginx body limit과 base64 33% 팽창 문제를 정리했다.