Zunifikowane rozwiΔ zanie AI z obsΕugΔ gΕosu, wizji i automatyzacji
Jeden projekt obsΕugujΔ cy dwa tryby wdroΕΌenia:
streamware/
βββ orchestrator/ # GΕΓ³wny kod aplikacji
β βββ main.py # Entry point
β βββ text2dsl.py # NL β DSL conversion
β βββ llm_engine.py # LLM wrapper
β βββ audio/ # STT + TTS
β βββ vision/ # Cameras + Detection
β βββ adapters/ # Docker, MQTT, Firmware
βββ config/ # Konfiguracja
β βββ config.yaml # Unified config (mode: docker/embedded)
βββ scripts/ # Skrypty instalacyjne i pomocnicze
βββ tests/ # Testy jednostkowe
βββ docs/ # Dokumentacja
βββ firmware/ # IoT simulator
βββ models/ # Modele AI (whisper, yolo, piper)
βββ docker-compose-*.yml # Docker deployment configs
βββ Makefile # Build & run commands
βββ requirements.txt # Python dependencies
βββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββ
β STREAMWARE β
βββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββ€
β [Audio STT] βββ β
β (Whisper) ββββΊ [LLM] βββΊ [Text2DSL] βββΊ [Adapters] β
β [Cameras] ββββ (Ollama) β β
β ββ USB ββββββ΄βββββ β
β ββ RTSP (IP) β β β
β ββ CSI (Jetson) [Vision] [Docker] [MQTT] β
β (YOLO) β β β
β [TTS Piper] βββββββββββββββββββββ Containers IoT β
βββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββββ
# Konfiguracja
cp config/config.yaml config/config.yaml.local
# Ustaw: mode: "docker"
# Development (pojedynczy kontener)
make docker-dev
# Production (peΕny stack)
make docker-prod
# Lub bezpoΕrednio:
docker-compose -f docker-compose-single.yml up
# Instalacja
make install
# Lub rΔcznie:
./scripts/install.sh
source venv/bin/activate
# Konfiguracja
# Ustaw w config/config.yaml: mode: "embedded"
# Uruchomienie
make run
# Lub:
python -m orchestrator.main
"Zrestartuj backend"
"PokaΕΌ logi frontend 20 linii"
"Status kontenerΓ³w"
"Zatrzymaj bazΔ danych"
"Co widzisz?"
"Ile osΓ³b jest w kadrze?"
"Gdzie jest laptop?"
"Dodaj kamerΔ rtsp://192.168.1.100:554/stream"
"Lista kamer"
"Jaka jest temperatura w salonie?"
"WΕΔ
cz ΕwiatΕo w kuchni"
"Ustaw termostat na 22 stopnie"
| Cecha | Docker (Enterprise) | Embedded (Jetson) |
|---|---|---|
| Deployment | Docker Compose | Native Python |
| Hardware | Server/PC | Jetson/Edge |
| RAM | 8GB+ | 8GB |
| GPU | Optional | Required (CUDA) |
| Cameras | Multi (USB/RTSP/HTTP) | Multi + CSI |
| Docker control | β | β |
| MQTT | β | Optional |
| TensorRT | Optional | β Recommended |
| Latency | ~1s | ~700ms |
| Offline | Partial | β Full |
| Komponent | Technologia | Opis |
|---|---|---|
| STT | Faster-Whisper | Speech-to-Text, modele small/medium |
| TTS | Piper | Text-to-Speech, polski gΕos |
| LLM | Ollama + Phi-3 | Lokalny LLM 3.8B parametrΓ³w |
| Vision | YOLOv8 + TensorRT | Detekcja obiektΓ³w real-time |
| Cameras | OpenCV + GStreamer | Multi-source video capture |
| MQTT | Eclipse Mosquitto | IoT communication |
| Docker | Docker SDK | Container management |
# Uruchomienie wszystkich testΓ³w
make test
# Lub bezpoΕrednio:
pytest tests/ -v
# Z coverage
make test-cov
MIT License - Softreck / prototypowanie.pl
UΕΌywaj dowolnie w projektach komercyjnych i niekomercyjnych.
/docs w kaΕΌdym projekcie