Skip to content

Commit fd86dbe

Browse files
committed
chore: Notion 동기화 2026-07-15 11:00
1 parent 9cdd43c commit fd86dbe

3 files changed

Lines changed: 13 additions & 10 deletions

blog/.notion-sync.json

Lines changed: 4 additions & 4 deletions
Original file line numberDiff line numberDiff line change
@@ -15,15 +15,15 @@
1515
},
1616
"399e15b4-0359-8061-8695-ec051ca2bc89": {
1717
"file": "blog/2026-07-10-07-음성분석-처리-과정-및-결과.md",
18-
"last_edited": "2026-07-14T08:54:00.000Z",
19-
"content_hash": "0e5b6487e8fe0cc6ea270fdeee3fae8b04f18663bbeb9abfda63cc2a4713f2a1",
18+
"last_edited": "2026-07-15T01:09:00.000Z",
19+
"content_hash": "543815cdac0fe2a7794def6d5e5d8e70a574d0f585f2f5e1962ccc19081e0140",
2020
"order": 3,
2121
"parent_id": null
2222
},
2323
"399e15b4-0359-80bc-a362-f310d7425d86": {
2424
"file": "blog/2026-07-10-07-faster-whisper-한국어-음성인식-최적화-경험-공유.md",
25-
"last_edited": "2026-07-14T10:08:00.000Z",
26-
"content_hash": "5ed1b6f1658f249fd524c1d0da9fd12f4fee727d5065f736487b5aef2a96fd3c",
25+
"last_edited": "2026-07-15T01:11:00.000Z",
26+
"content_hash": "d82806672b539bed4b13409306cfeb3e3b028e33431094aaf657f2665e972e66",
2727
"order": 4,
2828
"parent_id": null
2929
},

blog/2026-07-10-07-faster-whisper-한국어-음성인식-최적화-경험-공유.md

Lines changed: 7 additions & 4 deletions
Original file line numberDiff line numberDiff line change
@@ -5,20 +5,20 @@ slug: 4
55
authors: [sbin]
66
description: "이 글은 음성을 글자 변환 (Speech to Text) 하는 과정을 구체적으로 명시한 글이다"
77
last_update:
8-
date: 2026-07-14
8+
date: 2026-07-15
99
---
1010

1111
### 들어가며
1212

1313
---
1414

15-
faster-whisper-large-v3 로 음성 인식 작업을 진행하였다.
15+
faster-whisper-large-v3 로 음성 인식 작업을 진행하면서, 최적화 작업까지 진행하였다.
1616

1717
<!--truncate-->
1818

1919
간단히 요약하면
2020

21-
1. transcribe 실행. segment 결과 추출
21+
1. transcribe 실행 하여 Specch-to-Text 진행. segment 결과 추출
2222
2. for 루프 검사, 결과물 필터하여 모델 최적화
2323

2424
라고 할 수 있다.
@@ -56,7 +56,10 @@ def _do_transcribe(audio_np: np.ndarray, language: str) -> tuple[list, float]:
5656
return segs, sum(s.avg_logprob for s in segs) / len(segs)
5757
```
5858

59-
- 해당 파라미터 값 (beam_size, log_prob_threshold 등) 은, 패키지 함수 시그니처에 있는 것과 동일함을 확인
59+
- 해당 파라미터 값 (beam_size, log_prob_threshold 등) 조회 결과, 패키지 함수 시그니처에 있는 것과 동일함을 확인
60+
- 시그니처란, 해당 오픈 소스에서 설정한 값을 의미
61+
62+
- PoC 에서도 동일하게 진행
6063

6164

6265
### 2. 결과물 필터

blog/2026-07-10-07-음성분석-처리-과정-및-결과.md

Lines changed: 2 additions & 2 deletions
Original file line numberDiff line numberDiff line change
@@ -4,7 +4,7 @@ date: 2026-07-10
44
slug: 3
55
authors: [sbin]
66
last_update:
7-
date: 2026-07-14
7+
date: 2026-07-15
88
---
99

1010
### 들어가며
@@ -161,7 +161,7 @@ def detect(audio_np: np.ndarray, sr: int = 16000) -> list[tuple[float, float]]:
161161

162162
#### 3. 화자 분리
163163

164-
- 하나의 영상에는 다양한 사람이 나오고, 그 사람들의 목소리는 당연히 다르다.
164+
- 영상에는 다양한 사람이 나오고, 그 사람들의 목소리는 당연히 다르다.
165165
- **이번엔** **화자를 구분 시키는 부분** 이다. 오픈소스 라이브러리. pyannotate 도입하였다.
166166

167167
```python

0 commit comments

Comments
 (0)