Metadata-Version: 2.5
Name: nusadata
Version: 9.0.0
Summary: Bahasa Pemrograman Data Nusantara — Bicara soal Data, Pakai Bahasa Kita Sendiri
Project-URL: Homepage, https://nusadata.dev
Project-URL: Documentation, https://docs.nusadata.dev
Project-URL: Repository, https://github.com/nusadata/nusadata
Project-URL: Issues, https://github.com/nusadata/nusadata/issues
Project-URL: Discord, https://discord.gg/nusadata
Author-email: NUSADATA Team <hello@nusadata.dev>
License-Expression: MIT
Keywords: data-analysis,data-science,indonesian,machine-learning,programming-language,transpiler,visualization
Classifier: Development Status :: 4 - Beta
Classifier: Intended Audience :: Developers
Classifier: Intended Audience :: Education
Classifier: Intended Audience :: Science/Research
Classifier: License :: OSI Approved :: MIT License
Classifier: Programming Language :: Python :: 3.12
Classifier: Programming Language :: Python :: 3.13
Classifier: Programming Language :: Python :: 3.14
Classifier: Topic :: Scientific/Engineering :: Information Analysis
Classifier: Topic :: Scientific/Engineering :: Visualization
Classifier: Topic :: Software Development :: Compilers
Requires-Python: >=3.12
Requires-Dist: beautifulsoup4>=4.12.0
Requires-Dist: click>=8.1.0
Requires-Dist: httpx>=0.27.0
Requires-Dist: lark>=1.2.0
Requires-Dist: matplotlib>=3.8.0
Requires-Dist: openpyxl>=3.1.0
Requires-Dist: pandas>=2.2.0
Requires-Dist: plotly>=5.18.0
Requires-Dist: polars>=0.20.0
Requires-Dist: rich>=13.7.0
Requires-Dist: scikit-learn>=1.4.0
Requires-Dist: scipy>=1.12.0
Requires-Dist: seaborn>=0.13.0
Requires-Dist: sqlalchemy>=2.0.0
Requires-Dist: statsmodels>=0.14.0
Requires-Dist: websockets>=12.0
Requires-Dist: xgboost>=2.0.0
Provides-Extra: dev
Requires-Dist: mypy>=1.8.0; extra == 'dev'
Requires-Dist: pre-commit>=3.6.0; extra == 'dev'
Requires-Dist: pytest-asyncio>=0.23.0; extra == 'dev'
Requires-Dist: pytest-cov>=4.1.0; extra == 'dev'
Requires-Dist: pytest>=8.0.0; extra == 'dev'
Requires-Dist: ruff>=0.2.0; extra == 'dev'
Description-Content-Type: text/markdown

# 🇮🇩 NUSADATA

**Bahasa Pemrograman Data Nusantara**

> *"Bicara soal Data, Pakai Bahasa Kita Sendiri"*

---

[![Version](https://img.shields.io/badge/version-9.0.0-blue.svg)](https://github.com/nusadata/nusadata)
[![Python](https://img.shields.io/badge/python-3.12+-green.svg)](https://python.org)
[![Tests](https://img.shields.io/badge/tests-869%2B-brightgreen.svg)]()
[![License](https://img.shields.io/badge/license-MIT-yellow.svg)](LICENSE)

---

## Apa itu NUSADATA?

**NUSADATA** adalah bahasa pemrograman data berbasis Python yang ditulis sepenuhnya dalam **Bahasa Indonesia** dengan gaya komunikasi **Generasi Z** — kasual, langsung, mudah dipahami, tetapi tetap profesional dan powerful.

### Perbandingan

| Aspek | Python | R | SQL | **NUSADATA** |
|-------|--------|---|-----|--------------|
| Syntax | Inggris | Inggris | Inggris | **Indonesia Gen Z** |
| Learning Curve | Sedang | Curam | Sedang | **Sangat Mudah** |
| Data Science | ✅ | ✅ | ❌ | **✅ Built-in** |
| Visualisasi | Perlu Library | Built-in | ❌ | **Built-in** |
| ML/AI | Perlu Library | Perlu Library | ❌ | **Built-in** |
| Database | Perlu Setup | Perlu Setup | ✅ | **Built-in** |
| Package Manager | pip | install.packages | ❌ | **nusadata install** |
| Error Messages | Inggris Teknis | Inggris Teknis | Inggris | **🇮🇩 Indonesia Ramah** |

---

## Quick Start

### Install

```bash
pip install nusadata
```

### Hello World

Buat file `halo.nds`:

```nusadata
tampilin "Halo, Dunia! 🇮🇩"
```

Jalankan:

```bash
nusadata jalankan halo.nds
```

### Analisis Data

```nusadata
// Baca data penjualan
masukin data dari "penjualan.csv"

// Lihat info
tampilin data.lima_baris_pertama()

// Statistik
tampilin "Rata-rata: " + teks(data.kolom("harga").rata_rata())
tampilin "Total: " + teks(data.kolom("total").jumlah())

// Filter
punya teknologi = data[data["kategori"] == "Teknologi"]
tampilin "Teknologi: " + teks(teknologi.jumlah_baris()) + " produk"

// Visualisasi
gambarrin data pakai "batang" dari kolom "kategori" dan "total"
```

---

## CLI Commands

```bash
# Jalankan program
nusadata jalankan program.nds
nusadata jalankan program.nds --debug    # Lihat kode Python
nusadata jalankan program.nds --show-ast # Lihat AST tree

# Mode interaktif (REPL)
nusadata mulai

# Buat project baru
nusadata buat my_project

# Compile ke Python
nusadata kompile program.nds

# Package manager
nusadata install nusadata.stats
nusadata packages

# Info
nusadata versi
nusadata dokumentasi
nusadata test
```

### REPL Commands

```
nusadata> bantuan     # Tampilkan bantuan
nusadata> variabel    # Lihat semua variabel
nusadata> riwayat     # Lihat riwayat perintah
nusadata> bersihkan   # Bersihkan layar
nusadata> keluar      # Keluar
```

---

## Fitur Utama

### 📊 Data Operations

```nusadata
masukin data dari "penjualan.csv"

// Filter
punya filtered = data[data["harga"] > 100000]

// Sort
punya sorted = data.urutin("total", "menurun")

// GroupBy
punya grouped = data.kelompokin("kategori").agg({"total": "sum"})

// Clean
punya bersih = data.bersihin().buang_duplikat()
```

### 📈 Statistik

```nusadata
tampilin data.kolom("harga").rata_rata()
tampilin data.kolom("harga").tengah()
tampilin data.kolom("harga").terkecil()
tampilin data.kolom("harga").terbesar()
tampilin data.kolom("total").jumlah()
tampilin data.ringkasan()
```

### 📊 Visualisasi

```nusadata
gambarrin data pakai "batang" dari kolom "kategori" dan "total"
gambarrin data pakai "garis" dari kolom "tanggal" dan "penjualan"
gambarrin data pakai "lingkaran" dari kolom "total" dan "kategori"
gambarrin data pakai "titik" dari kolom "umur" dan "pendapatan"
```

### 🤖 Machine Learning

```nusadata
model.latih(data_latih, y_latih)
punya prediksi = model.tebak(data_uji)
tampilin model.akurasi()
```

### 📦 Package Manager

```bash
nusadata install nusadata.stats    # Install package
nusadata packages                  # Lihat semua packages
```

### 🇮🇩 Error Handling Ramah

```
┌─────────────────────────────────────────────────────┐
│  ❌  Kolom atau key "hrga" ga ditemukan.            │
│                                                     │
│  💡 Cek ejaan nama kolomnya.                        │
│     Ketik data.kolom_semua() untuk lihat semua.     │
│                                                     │
│  📝 Tipe error: KeyError                            │
└─────────────────────────────────────────────────────┘
```

---

## Keyword Lengkap

| Konsep | Keyword | Contoh |
|--------|---------|--------|
| Variabel | `punya` | `punya nama = "Budi"` |
| Fungsi | `aksi` | `aksi sapa(nama):` |
| Kondisi | `kalo` | `kalo umur > 17:` |
| Loop | `ulang` | `ulang i dari 1 sampai 5:` |
| Tampil | `tampilin` | `tampilin "Halo"` |
| Data | `masukin` | `masukin data dari "file.csv"` |
| Filter | `saring` | `data.saring("harga", ">", 10000)` |
| Sort | `urutin` | `data.urutin("tanggal", "menurun")` |
| Group | `kelompokin` | `data.kelompokin("kategori").jumlah()` |
| Chart | `gambarrin` | `gambarrin data pakai "batang"` |
| ML | `latih` | `model.latih(X, y)` |
| DB | `tanya` | `tanya "SELECT * FROM tabel"` |
| Comprehension | `[x * 2 untuk x dalam data]` | List comprehension |
| Dict Comp | `{k: v untuk x dalam data}` | Dict comprehension |
| Set Ops | `gabung_set(a, b)` | Set union/intersection/difference |
| Null Coalescing | `x ?? default` | Null coalescing operator |
| Optional Chain | `obj?.attr` | Optional chaining |
| Ternary | `kalo x > 0 ? "ya" : "tidak"` | Ternary expression |

Lihat [Cheat Sheet Lengkap](docs/cheat-sheet.md) untuk daftar lengkap.

---

## Struktur Direktori

```
nusadata/
├── src/
│   └── nusadata/
│       ├── __init__.py          # Package init
│       ├── lexer.py             # Tokenizer (60+ keywords)
│       ├── parser.py            # Parser (AST generator)
│       ├── codegen.py           # Python code generator
│       ├── runtime/             # Runtime engines
│       │   ├── handler.py       # Error handler (friendly messages)
│       │   ├── dataframe.py     # DataFrame operations
│       │   ├── stats.py         # Statistics engine
│       │   ├── chart.py         # Visualization engine
│       │   ├── ml.py            # Machine Learning engine
│       │   ├── clean.py         # Data cleaning engine
│       │   └── db.py            # Database connector
│       ├── packages/            # Package manager
│       │   ├── __init__.py      # PackageRegistry class
│       │   └── registry.json    # Package registry
│       └── cli/                 # Command line tools
│           └── main.py          # Main CLI entry
├── tests/                       # 475+ tests
│   ├── test_lexer.py           # 76 tests
│   ├── test_parser.py          # 81 tests
│   ├── test_codegen.py         # 115 tests
│   ├── test_integration.py     # 23 tests
│   ├── test_runtime.py         # 76 tests
│   ├── test_cli.py             # 40 tests
│   ├── test_cli_enhancements.py # 23 tests
│   └── test_e2e.py             # 41 tests
├── examples/
│   └── data/                   # Sample datasets
│       ├── penjualan.csv       # 20 records
│       ├── siswa.csv           # 15 records
│       └── produk.csv          # 10 records
├── docs/                       # Documentation
│   ├── architecture.md         # Arsitektur teknis
│   ├── cheat-sheet.md          # Cheat sheet lengkap
│   ├── cli-reference.md        # CLI reference
│   └── examples.md             # Contoh program
├── pyproject.toml              # Project configuration
└── README.md                   # This file
```

---

## Arsitektur

```
Source Code (.nds)
       ↓
   [Lexer] → Tokens (60+ keywords)
       ↓
   [Parser] → AST (Abstract Syntax Tree)
       ↓
   [Code Generator] → Python Code (auto-import tracking)
       ↓
   [Runtime Engine] → Output
       ├── DataFrame Engine (Pandas/Polars)
       ├── Statistics Engine (SciPy/Statsmodels)
       ├── Visualization Engine (Matplotlib/Plotly)
       ├── ML Engine (Scikit-learn/XGBoost)
       ├── Cleaning Engine (Pandas)
       └── Database Connector (SQLAlchemy)
```

---

## Test Coverage

| Module | Tests | Status |
|--------|-------|--------|
| Lexer | 99 | ✅ |
| Parser | 69 | ✅ |
| Codegen | 115 | ✅ |
| Integration | 23 | ✅ |
| Runtime | 76 | ✅ |
| CLI | 40 | ✅ |
| CLI Enhancements | 23 | ✅ |
| E2E (CSV) | 41 | ✅ |
| Upgrades V1-V8.5 | 392 | ✅ |
| **Upgrades V9.0** | **25** | **✅** |
| **Total** | **869** | **✅ All pass** |

---

## Target Performance

| Metrik | Target |
|--------|--------|
| Startup time | < 2 detik |
| Parse speed | > 10,000 baris/detik |
| Memory usage | < 500 MB untuk dataset 1M baris |
| Compilation | < 1 detik untuk file 1000 baris |
| ML Training | Overhead < 10% vs Python |

---

## Kontribusi

Kami sangat terbuka untuk kontribusi! Silakan:

1. Fork repository ini
2. Buat branch baru (`git checkout -b fitur/nama-fitur`)
3. Commit perubahanmu (`git commit -m 'Tambah fitur baru'`)
4. Push ke branch (`git push origin fitur/nama-fitur`)
5. Buka Pull Request

---

## Lisensi

MIT License — Silakan gunakan untuk keperluan apapun.

---

## Kontak

- 🌐 Website: [nusadata.dev](https://nusadata.dev)
- 📚 Dokumentasi: [docs.nusadata.dev](https://docs.nusadata.dev)
- 💬 Discord: [discord.gg/nusadata](https://discord.gg/nusadata)
- 📧 Email: hello@nusadata.dev
- 🐙 GitHub: [github.com/nusadata](https://github.com/nusadata)

---

**NUSADATA — Data Kita, Bahasa Kita, Masa Depan Kita** 🇮🇩
