Cover artikel: Jev, model AI yang output-nya keputusan bertipe, bukan teks

Kenapa Jev Muncul Justru Saat LLM Makin Pintar

Empat tahun terakhir, hampir semua orang di industri ini kerja ke satu arah: bikin model yang makin enak diajak ngobrol. Metriknya jelas, demonya enak dilihat, dan hasilnya terasa. Dari RLHF yang ngajarin model menuruti selera manusia, sampai RLVR yang ngasih reward dari jawaban yang beneran terverifikasi. Puncaknya cuma satu: percakapan jadi antarmuka default buat segalanya. Termasuk buat hal yang sebenernya cukup dijawab satu kata. Terus 15 September 2026 keluar model yang nggak mau ngomong sama sekali. Namanya Jev, dibikin TypeSafe AI. Yang bikin rame di Hacker News bukan cuma modelnya, tapi siapa yang bikin: Diogo Almeida, orang yang sekitar empat tahun kerja di OpenAI di balik RLHF, InstructGPT, ChatGPT, dan GPT-4. Thread peluncurannya nyangkut di 1.977 poin dengan 513 komentar. ...

24 September 2026 · 8 min · 1583 words · Reynaidi Siburian
Cover artikel: arsitektur multi-agent AI dari sisi bisnis dan teknologi

Multi-Agent AI: Arsitektur Bisnis dan Teknologi per Layer

Satu agent itu kayak satu karyawan generalis. Bisa ngerjain banyak hal, tapi ada plafonnya. Gue pernah lihat pola yang sama berulang: satu agent awalnya pinter, terus kerjaannya meluas, konteks yang harus dibaca makin banyak, dan hasilnya perlahan mulai ngaco. Reaksi pertama hampir selalu sama: tambah agent. Satu buat riset, satu buat verifikasi, satu buat nulis. Kelihatannya logis, persis kayak nambah orang di tim. Masalahnya, di sistem AI nambah agent itu nggak otomatis nambah kualitas. Anthropic pernah ngukur sistem multi-agent mereka, dan hasilnya 90,2% lebih baik dari single agent di evaluasi riset internal mereka. Tapi catatan yang sama pentingnya ada di paragraf sebelahnya: sistem itu pakai token sekitar 15x lebih banyak dibanding chat biasa. Di sisi lain, ada studi yang nyamain anggaran token antara single agent dan multi-agent, dan di kondisi itu single agent setara atau justru lebih baik di tugas penalaran bertahap. ...

21 September 2026 · 14 min · 2935 words · Reynaidi Siburian
Cover artikel: arsitektur agentic AI layer demi layer

Agentic AI: Bongkar Mesin di Balik AI yang Kerja Sendiri

“Kok bisa sih AI tiba-tiba nyelesaiin kerjaan sendiri, kayak ada manusia yang eksekusi?” Gue yakin pertanyaan itu pernah lewat di kepala lo, apalagi setelah nonton demo AI agent yang bisa buka browser, klik sana-sini, isi form, dan ngelaporin hasilnya. Kelihatannya seperti robot yang lagi gerak sendiri. Padahal di baliknya gak ada yang mistis: yang ada cuma model bahasa, daftar alat (tools), dan satu loop eksekusi yang jalan berulang-ulang. ...

27 Agustus 2026 · 9 min · 1744 words · Reynaidi Siburian
Peta arsitektur model AI bahasa untuk bisnis

Peta Arsitektur AI untuk Bisnis: LLM, SLM, dan Lainnya

“Gue mau pake AI buat bisnis. Pake GPT aja, kan?” Kalo lo pernah denger pertanyaan kayak gini di kantor, lo pasti tau masalahnya. Orang langsung loncat ke nama model, padahal pertanyaan yang lebih penting: model jenis apa, sebesar apa, dijalanin di mana, dan dibungkus arsitektur kayak gimana. ...

11 Agustus 2026 · 9 min · 1863 words · Reynaidi Siburian
Ilustrasi RAG system hardening - 3 fase pipeline security

Hardening RAG System: 3 Fase Mengamankan Dari Input Sampe Output

Lo udah deploy RAG system. Retrieval-nya jalan, generation-nya lancar, user puas. Tapi pernah mikir gak - berapa banyak pintu yang kebuka buat attacker? Vector DB yang gak diamankan. Prompt injection lewat dokumen yang di-retrieve. Data sensitif yang lolos ke output. RAG punya surface area yang lebih luas dari LLM standalone, dan banyak orang baru sadar setelah kejadian. ...

29 Juli 2026 · 8 min · 1542 words · Reynaidi Siburian
Ilustrasi perbandingan format model LLM - GGUF, AWQ, GPTQ, EXL2

GGUF, AWQ, GPTQ, EXL2 - Pilih yang Mana Buat Model LLM lo?

Lo download model Llama, Mistral, atau Qwen. Di halaman Hugging Face ada puluhan file: .gguf, .awq, .gptq, .exl2, .safetensors. Lo bingung milih yang mana. Gue juga dulu gitu. Masalahnya: salah pilih format = buang resource. Format yang salah bikin GPU lo nganggur, CPU lo overload, atau model lo gak bisa jalan sama sekali. ...

9 Juni 2026 · 7 min · 1321 words · Reynaidi Siburian
Ilustrasi AI yang mulai ngaco di tengah percakapan panjang - token attention bocor ke awal percakapan

Lo Ngobrol Sama AI Lama-Lama Kok Makin Ngaco? Ini Sebabnya - Bukan Lo Aja Yang Ngerasain

🎣 Hook Lo lagi asyik ngobrol sama ChatGPT, Claude, atau DeepSeek. Di awal, jawabannya tajam. Detail. Nyambung terus sama konteks yang lo kasih. Tapi makin panjang percakapan, mulai aneh. Dia lupa lo udah bilang apa 10 pesan lalu. Mulai ngulang informasi yang udah pernah dikasih. Tiba-tiba jawabannya jadi generik, kayak lagi ngobrol sama orang yang baru dateng di tengah diskusi. ...

5 Juni 2026 · 10 min · 2043 words · Reynaidi Siburian
Diagram arsitektur 6 layer hardening Ollama di AWS/GCP

Hardening Ollama di Cloud: Panduan Bertahap Biar AI Lo Gak Dipake Orang

Masalahnya: Lo Install, Trus ?? Ollama itu tools keren. Install gampang, model jalan, API siap dipake. Tapi ada satu fakta yang jarang disebut tutorial instalasi cepet: Ollama gak punya built-in authentication. ...

2 Juni 2026 · 6 min · 1143 words · Reynaidi Siburian