Metadata-Version: 2.1
Name: dlu_voice_transcriber
Version: 0.2.3
Summary: A multilingual voice recording and transcription tool with German and English support
Author-email: Dirk Ulbricht <dirk.ulbricht@gmail.com>
License: MIT
Project-URL: Homepage, https://github.com/dullibri/dlu_voice_transcriber
Project-URL: Bug Tracker, https://github.com/dullibri/dlu_voice_transcriber/issues
Project-URL: Documentation, https://github.com/dullibri/dlu_voice_transcriber#readme
Project-URL: Source Code, https://github.com/dullibri/dlu_voice_transcriber
Project-URL: Changelog, https://github.com/dullibri/dlu_voice_transcriber/blob/main/CHANGELOG.md
Keywords: audio recording,speech recognition,transcription,german transcription,voice to text,multilingual,audio processing
Classifier: Development Status :: 4 - Beta
Classifier: Programming Language :: Python :: 3
Classifier: Programming Language :: Python :: 3.8
Classifier: Programming Language :: Python :: 3.9
Classifier: Programming Language :: Python :: 3.10
Classifier: Programming Language :: Python :: 3.11
Classifier: License :: OSI Approved :: MIT License
Classifier: Operating System :: OS Independent
Classifier: Topic :: Multimedia :: Sound/Audio :: Speech
Classifier: Topic :: Multimedia :: Sound/Audio :: Capture/Recording
Classifier: Natural Language :: English
Classifier: Natural Language :: German
Classifier: Intended Audience :: Developers
Classifier: Intended Audience :: Education
Classifier: Intended Audience :: End Users/Desktop
Requires-Python: <3.12,>=3.8
Description-Content-Type: text/markdown
License-File: LICENSE
Requires-Dist: pyaudio>=0.2.14
Requires-Dist: SpeechRecognition>=3.11.0
Requires-Dist: pydub>=0.25.1
Requires-Dist: wave>=0.0.2

# DLU Voice Transcriber

A Python tool for recording audio and transcribing it to text in multiple languages (English and German).

## Features

- High-quality audio recording (48kHz sample rate, 16-bit depth)
- Automatic input device detection and selection
- Support for multiple audio formats (WAV, MP3)
- Configurable MP3 quality settings
- Transcription to English and German
- Progress monitoring during recording
- Save transcriptions to text files
- Detailed device information and listing
- Intelligent device selection with native sample rate support

## Installation

```bash
pip install dlu_voice_transcriber
```

### System Requirements

- Python 3.8 or higher
- Working microphone
- Linux: `sudo apt-get install python3-pyaudio portaudio19-dev`
- macOS: `brew install portaudio`
- Windows: No additional requirements

## Usage

### Basic Commands

List available audio devices:
```bash
dlu_transcribe --list-devices
```

Basic recording (5 seconds, default settings):
```bash
dlu_transcribe
```

### Advanced Usage

Record with specific settings:
```bash
dlu_transcribe --device 2 --duration 10 --output my_recording --format mp3 --mp3-quality 320 --language both --save-text
```

### Command Line Options

- `--device`: Specify input device index (shown by --list-devices)
- `--duration`: Recording duration in seconds (default: 5)
- `--output`: Output filename without extension (default: recording)
- `--format`: Output format: 'wav' or 'mp3' (default: mp3)
- `--mp3-quality`: MP3 quality in kbps (default: 320)
- `--language`: Transcription language: 'de', 'en', or 'both' (default: both)
- `--save-text`: Save transcriptions to text files
- `--list-devices`: Show available audio input devices

### Examples

List all available devices:
```bash
dlu_transcribe --list-devices
```

Record high-quality MP3 for 15 seconds:
```bash
dlu_transcribe --duration 15 --format mp3 --mp3-quality 320 --output high_quality_recording
```

Record using specific device with German-only transcription:
```bash
dlu_transcribe --device 2 --language de --save-text --output german_speech
```

## Output Files

The tool generates the following files in the `recordings` directory:
- Audio file: `<output>.<format>` (e.g., recording.mp3)
- Transcription files (if --save-text is used):
  - English: `<output>_en.txt`
  - German: `<output>_de.txt`

## License

This project is licensed under the MIT License - see the LICENSE file for details.
