DashboardIngestion & Upload

Ingestion & Upload Hub

Tanya AI

Unggah Dokumen PDF

Setiap halaman diekstrak oleh Agent 1 (Google Gemini Flash-Lite Vision) & diindeks oleh Agent 2 (OpenAI)

PDF Only

Tarik & lepaskan file PDF di sini

atau klik untuk memilih dokumen dari komputer Anda

Slide PresentasiDokumen ScanLaporan Teknis

Pipeline Ingestion AI Vision

Prinsip ekstraksi bertahap dari dokumen fisik ke dense vector pgvector

1
In-Memory Render
PDF dirender ke gambar tanpa disimpan ke disk
2
Vision OCR (Qwen 2.5)
AI Vision mengekstrak teks tiap halaman
3
Sliding Window
Chunking 800 char dengan overlap 150
4
Dense Embedding (BGE-M3)
Vector 1024-dim disimpan ke pgvector