Model Release
GPT-Live-1 API란? 전이중 음성 에이전트 구조와 비용
GPT-Live-1 API가 기존 STT·LLM·TTS 구조와 어떻게 다르고, 백엔드 위임·끼어들기 처리·분당 비용을 어떻게 봐야 하는지 정리합니다.
공식 문서와 원본 저장소를 대조해, 설치 절차·판단 기준·실패 조건까지 정리한 실무 가이드입니다.
단순 발표 요약은 공개하지 않습니다. 각 글은 독자가 직접 재현하거나 도입 여부를 판단할 수 있는 내용만 남깁니다. 작성자와 편집 기준 보기
Model Release
GPT-Live-1 API가 기존 STT·LLM·TTS 구조와 어떻게 다르고, 백엔드 위임·끼어들기 처리·분당 비용을 어떻게 봐야 하는지 정리합니다.
Paper Review
A Defense of the Quadratic Model의 Gauss–Newton 근사, Lanczos spectrum과 학습 안정성을 설명한다. batch 64 예제, 원문 figure·table, 공개 코드로 근사가 맞는 조건과 반례를 분석한다.
AI Coding Tools
AirLLM의 레이어 이동 구조와 70B 가중치의 저장공간·전송시간을 가정별로 계산합니다. 제작사 실행 주장과 직접 계산한 값을 구분한 도입 검토 가이드입니다.
Work Automation
개인정보처리방침 생성 스킬에 넘길 서비스 사실관계 점검표와 초안 대조 방법입니다. 법령 조건과 확인되지 않은 입력을 구분해 잘못된 고지를 줄입니다.
Work Automation
GL4SS는 별도 앱 백엔드 없이 브라우저에서 OpenRouter API를 호출합니다. 서버형 생성 서비스, 로컬 모델 구동과 비교해 어떤 상황에 이 구조가 맞는지 정리했습니다.
AI Coding Tools
Mantis 보안 리뷰 파이프라인을 도입하기 전에 확인할 권한·격리·재현·패치 검토 기준입니다. 실행 완료 주장 대신 파일럿 기록 양식을 제공합니다.
AI Coding Tools
Anthropic의 컨텍스트 엔지니어링 설명을 바탕으로, 실제 블로그 생성 규칙의 글자 수·그림 수·검증 기준 충돌을 찾아 고친 사례를 보여드립니다.
AI Coding Tools
spec-kit의 명세·계획 분리 방법을 실제 블로그 링크 검사 문제에 적용합니다. 버전을 고정한 설치 예시와 spec·plan·tasks 자료, 모호한 요구를 검증 조건으로 바꾸는 과정을 제공합니다.
AI Coding Tools
Codex용 oh-my-design 2.0.0을 실제 설치하고 doctor 결과를 확인했습니다. 설치와 디자인 기준 완성을 구분하고, 기준서와 반응형 HTML 예제를 제공합니다.
Work Automation
OfficeCLI 1.0.149로 한국어 PPT를 만들고 가상 데이터의 잘못된 비율을 수정했습니다. 입력 JSON, 수정 전후 PPT와 실제 실행 기록을 제공합니다.
Paper Review
IndexTTS v1의 SEQ3 입력, Conformer·Perceiver와 BigVGAN2 구조를 설명한다. 병음 교정률 94%의 분모, CER·WER·SS·MOS와 inference 속도를 원문 figure·table과 코드로 분석한다.
Paper Review
IndexTTS2의 T2S·S2M, GRL 감정 분리, GPT latent와 duration control을 설명한다. WER·SS·MOS, ablation과 공개 inference 코드의 제한을 원문 figure·table로 분석한다.
Paper Review
IndexTTS2.5의 multilingual TTS, 언어 conditioning, GRPO와 25Hz codec을 설명한다. 언어별 WER·SS, cross-lingual 감정 전이와 Zipformer·공개 DiT 구현의 차이를 분석한다.
Paper Review
LatentMoE의 down-projection·expert·up-projection을 계산 예제로 설명한다. 95B·hybrid benchmark, 실제 throughput과 3.46배 simulation, Megatron-Core 구현의 조건을 구분한다.
Paper Review
DataFlow의 storage·operator·pipeline·agent를 SQL 예제로 설명한다. pre-training·SFT 데이터 선별과 수학·코드·SQL·RAG benchmark를 원문 figure·table, 공개 구현과 함께 분석한다.
Paper Review
Nanbeige4.2-3B의 looped Transformer, executable data, SFT와 RLHF를 설명한다. length reward 계산, agent benchmark·평가 budget·공개 코드의 한계를 원문 figure·table로 분석한다.