Audio-Text-to-Text
Transformers
Safetensors
Japanese
English
llama_for_speech_lm
japanese
speech
audio
speech-to-text
llm-jp
Atotti commited on
Commit
a095c1b
·
verified ·
1 Parent(s): b5fe985

Update README.md

Browse files
Files changed (1) hide show
  1. README.md +2 -2
README.md CHANGED
@@ -69,7 +69,7 @@ tokenizer = AutoTokenizer.from_pretrained(MODEL_ID)
69
  tokenizer.pad_token = tokenizer.eos_token
70
 
71
  # Load audio
72
- waveform, sample_rate = torchaudio.load("sample.wav")
73
  if waveform.size(0) > 1:
74
  waveform = waveform.mean(dim=0, keepdim=True)
75
  waveform = waveform.squeeze(0)
@@ -192,7 +192,7 @@ tokenizer = AutoTokenizer.from_pretrained(MODEL_ID)
192
  tokenizer.pad_token = tokenizer.eos_token
193
 
194
  # 音声読み込み
195
- waveform, sample_rate = torchaudio.load("sample.wav")
196
  if waveform.size(0) > 1:
197
  waveform = waveform.mean(dim=0, keepdim=True)
198
  waveform = waveform.squeeze(0)
 
69
  tokenizer.pad_token = tokenizer.eos_token
70
 
71
  # Load audio
72
+ waveform, sample_rate = torchaudio.load("path/to/your_audio_file.wav")
73
  if waveform.size(0) > 1:
74
  waveform = waveform.mean(dim=0, keepdim=True)
75
  waveform = waveform.squeeze(0)
 
192
  tokenizer.pad_token = tokenizer.eos_token
193
 
194
  # 音声読み込み
195
+ waveform, sample_rate = torchaudio.load("path/to/your_audio_file.wav")
196
  if waveform.size(0) > 1:
197
  waveform = waveform.mean(dim=0, keepdim=True)
198
  waveform = waveform.squeeze(0)