AI 도서관 · Gemini · 상황별 프롬프트 · 강의 만들기

강의 녹음을 텍스트로 정리하기

3사 중 오디오를 받는 곳은 Gemini뿐입니다

내용

📌 먼저 알아둘 것 — 녹음 파일을 받는 곳이 다릅니다 (2026-09-10 확인)
• Gemini — 오디오를 직접 받습니다. API 문서 기준 프롬프트당 최대 9.5시간,
  WAV·MP3·AAC·FLAC 등. 02:30~03:29 처럼 구간을 지정할 수 있습니다
• Claude — 공식 지원 목록에 오디오·영상이 없습니다. mp3 를 넣어도 안 됩니다
• ChatGPT — 별도 확인이 필요합니다

⚠️ 위 수치는 Gemini API 문서 기준입니다. 앱에서의 제한은 다를 수 있습니다.
⚠️ 토큰이 꽤 듭니다 — 오디오 1초당 32토큰, 1분이면 1,920토큰입니다.
   90분 강의면 17만 토큰쯤 됩니다.

[ 녹음 파일을 첨부하고 사용하세요 ]

이 녹음을 정리해줘.

① 전체 흐름을 구간으로 나누고 각 구간 시각(MM:SS)과 한 줄 요약
② 실제로 다룬 내용만 정리 — 말하지 않은 것을 채우지 말 것
③ 말이 꼬이거나 중간에 정정한 부분 표시
④ 청중 질문과 그 답 (있으면)
⑤ 소리가 안 들려 확인 못 한 구간은 [확인 불가]로 시각과 함께

지켜줘
• 요약하면서 내가 안 한 말을 만들지 말 것
• 강의 내용의 사실 여부를 판정하지 말 것 — 말한 것을 옮기는 것까지
• 참석자 이름이 나오면 그대로 적지 말고 [이름]으로 바꿀 것

추가 요청: {{INPUT}}

⚠️ 녹음 전에 동의를 받으셨는지 확인하세요
   수강생 목소리와 질문이 함께 녹음됩니다. 그 자체가 개인정보일 수 있습니다.

💡 구간 시각을 요구하는 이유
나중에 그 대목을 다시 들어 확인할 수 있습니다. 시각이 없으면 검증이 안 됩니다.

{{INPUT}} 자리에 내 내용을 넣어 쓰는 프롬프트입니다. 아래 버튼으로 열면 넣는 칸이 나옵니다.

언제 쓰나 · 이미 진행한 강의 녹음을 문서로 남길 때

샘플 입력

질의응답 부분을 특히 자세히 정리해줘. 그리고 내가 설명하다 말이 꼬인 데가 있으면 알려줘.

(녹음 파일은 직접 첨부하세요. 아래는 무엇을 올리는지 보여주는 예입니다 —
 2026-09-05_사내교육_1부.mp3 / 90분)

이런 모양이면 잘 나온 것

우리가 쓴 예시입니다. 실제 실행 결과가 아니고, 답변은 매번 조금씩 다릅니다.

① 구간별 흐름
   00:00~08:20  들어가기 — 〈한 줄 요약〉
   08:20~26:40  〈주제〉 — 〈한 줄 요약〉
   26:40~41:10  〈주제〉 — 〈…〉
   ...

② 실제로 다룬 내용
   〈구간별로 말한 것만〉

③ 말이 꼬이거나 정정한 곳
   • 31:05 — 앞에서 A 라고 했다가 33:20 에 B 로 정정함
   • 52:14 — 문장을 끝맺지 않고 다음 주제로 넘어감

④ 청중 질문과 답
   • 1:04:30 [이름] — 질문 〈…〉 / 답 〈…〉

⑤ 확인 불가
   • 18:40~19:05 — 소리가 겹쳐 확인 불가

⚠️ 시각(MM:SS)이 없는 정리는 나중에 확인할 수 없습니다. 다시 시키세요.
⚠️ 강의에서 말하지 않은 내용이 요약에 들어갔다면 지어낸 것입니다.
⚠️ 참석자 실명이 그대로 남아 있으면 [이름]으로 바꾸세요.

받은 답 확인하기

잘못 나왔을 때 이어서 보낼 말

구간마다 MM:SS 시각을 붙여줘.
강의에서 말하지 않은 내용은 빼줘. 안 들리는 곳은 [확인 불가]로 시각과 함께 남겨줘.
참석자 이름은 [이름]으로 바꿔줘.

근거

유형
일반 프롬프트 — 대화창에 붙여넣습니다
사용 환경
Gemini (오디오 입력). Claude 는 오디오·영상을 받지 않습니다
사용 조건
API 문서 기준 프롬프트당 최대 9.5시간 · 오디오 1초당 32토큰. 앱 제한은 다를 수 있습니다
주의
녹음 전 동의를 확인하세요. 수강생 목소리와 질문도 함께 녹음됩니다.
공식 출처
https://ai.google.dev/gemini-api/docs/audio
확인일
2026-09-10 — 이후 바뀌었을 수 있습니다
도서관에서 열기 — 내 내용 넣고 복사하기