๐Ÿค– AI Ecosystem 2026

Peta lengkap semua model AI, token, teknologi, dan tren terbaru per Juli 2026

๐Ÿ“… 23 Juli 2026 โ€” Riset oleh Hermes Agent (Belajar AI Profile)
๐Ÿ”ฌ 15+ perusahaan ๐Ÿง  200+ model ๐Ÿ’ฐ $0.04 โ€“ $180 / M tok ๐Ÿ“ 4K โ€“ 2M context โšก 0.3 โ€“ 2600 t/s

๐Ÿ“‹ Daftar Isi

  1. Leaderboard Global
  2. Anthropic โ€” Claude
  3. OpenAI โ€” GPT
  4. Google โ€” Gemini & Gemma
  5. Meta โ€” Llama & Muse
  6. Mistral AI
  7. DeepSeek
  8. xAI โ€” Grok
  1. China Players
  2. Nous Research โ€” Hermes
  3. Other Players
  4. Tokenizers & Token System
  5. Perbandingan Harga
  6. AI News & Trends
  7. Glossary

๐Ÿ† Leaderboard Global โ€” Juli 2026

Berdasarkan Vellum LLM Leaderboard (1 Jul 2026). Benchmark: HLE (Humanity's Last Exam).

๐Ÿฅ‡ Best Overall โ€” HLE

#ModelScore
๐Ÿฅ‡Anthropic Claude Mythos 564.5%
๐ŸฅˆAnthropic Claude Opus 4.857.9%
๐Ÿฅ‰Anthropic Claude Sonnet 557.4%
4Zhipu GLM 5.254.7%
5Moonshot Kimi K2.654.0%
6DeepSeek DeepSeek V4 Flash51.6%
7DeepSeek DeepSeek V4 Pro48.2%
8Google Gemini 3 Pro45.8%
9Moonshot Kimi K2 Thinking44.9%
10Google Gemini 3.1 Pro44.4%
11OpenAI GPT-5.5 Pro43.1%
12OpenAI GPT-5.541.4%
13Google Gemini 3.5 Flash40.2%
14Anthropic Claude Opus 4.640.0%
15OpenAI GPT-535.2%
REASONING

GPQA Diamond

๐Ÿฅ‡ Claude Sonnet 596.2%
๐Ÿฅˆ Gemini 3.1 Pro94.3%
๐Ÿฅ‰ Claude Opus 4.794.2%
CODING

SWE-Bench

๐Ÿฅ‡ Claude Mythos 595.5%
๐Ÿฅˆ Claude Fable 595.0%
๐Ÿฅ‰ Claude Opus 4.888.6%
COMPUTER USE

OSWorld

๐Ÿฅ‡ Claude Fable 585.0%
๐Ÿฅˆ Claude Opus 4.883.4%
๐Ÿฅ‰ Claude Sonnet 581.2%
BROWSING

BrowseComp

๐Ÿฅ‡ Claude Fable 588.0%
๐Ÿฅˆ DeepSeek V4 Flash85.9%
๐Ÿฅˆ Gemini 3.1 Pro85.9%

โšก Fastest & Cheapest

๐Ÿš€ Tercepat

๐Ÿฅ‡ Llama 4 Scout2,600 t/s
๐Ÿฅˆ Llama 3.1 405B969 t/s
๐Ÿฅ‰ GLM 5.2347 t/s

๐Ÿ“ก Latensi Terendah

๐Ÿฅ‡ GPT-5.3 Codex0.003s
๐Ÿฅˆ Nova Micro0.3s
๐Ÿฅ‰ Llama 4 Scout0.33s

๐Ÿ’ฐ Termurah /1M

๐Ÿฅ‡ Nova Micro$0.04
๐Ÿฅˆ Gemini 1.5 Flash$0.075
๐Ÿฅ‰ Gemini 2.0 Flash$0.10

๐Ÿ”ด Anthropic โ€” Claude

Anthropic (San Francisco) โ€” memimpin global dengan Mythos 5. Semua model Claude 5 series punya 1M context window.

ModelContextCutoffInput / 1MOutput / 1MSpeed
Claude Mythos 5 #1 HLE1,000,000Jan 2026$10$50โ€”
Claude Fable 5 #1 Coding1,000,000Jan 2026$10$50โ€”
Claude Opus 4.81,000,000Jan 2026$5$2564.8 t/s
Claude Opus 4.71,000,000Apr 2026$5$2550.8 t/s
Claude Opus 4.6200,000May 2025$5$2567 t/s
Claude Sonnet 51,000,000Jan 2026$3$1556.3 t/s
Claude Haiku 4.5200,000โ€”$1$5โ€”

๐Ÿ“ฐ Riset Terbaru (Juli 2026)


๐ŸŸข OpenAI โ€” GPT Series

GPT-5.6 series: Sol (flagship), Terra (balance), Luna (cost-efficient). Semua 1.05M context.

ModelContextInput/1MOutput/1MReasoningCutoff
GPT-5.6 Sol FLAGSHIP1,050,000$5$30noneโ€“maxFeb 2026
GPT-5.6 Terra1,050,000$2.50$15noneโ€“maxFeb 2026
GPT-5.6 Luna1,050,000$1$6noneโ€“maxFeb 2026
GPT-5.5 Pro1,000,000$30$180โœ“Apr 2026
GPT-5.51,000,000$5$30โœ“Apr 2026
GPT-5.3 Codex400,000โ€”โ€”โœ“โ€”

Reasoning Models: o3, o3-mini, o3-pro, o4-mini (200K ctx). Spesial: GPT-Realtime-2.1, GPT-Image-2, GPT-4o Transcribe.


๐Ÿ”ต Google DeepMind โ€” Gemini & Gemma

Gemini Series

ModelContextInput / 1MOutput / 1MSpeed
Gemini 3.1 Pro1,000,000$2$12136.2 t/s
Gemini 3.5 Flash1,000,000$1.50$9175.4 t/s
Gemini 3 Flash1,000,000$0.50$3โ€”
Gemini 3.1 Flash Lite1,000,000$0.25$1.50โ€”
Gemini 2.5 Pro1,000,000$1.25$10โ€”
Gemini 2.5 Flash1,000,000$0.30$2.50โ€”

Gemma Series (Open-Weight)

ModelParamsContextInput / 1M
Gemma 4 26B-a4B26B (4B active MoE)262,144$0.12
Gemma 4 31B31B262,144$0.12
Gemma 3 27B27B262,144$0.10
Gemma 3 12B12B131,072$0.05
Gemma 3 4B4B131,072$0.05

๐Ÿ”ต Meta โ€” Llama & Muse

ModelContextCatatan
Llama 4 Maverick1,048,576Flagship reasoning
Llama 4 Scout1,310,720Termurah & tercepat (2,600 t/s)
Meta Muse Sparkโ€”Menggantikan Llama sejak Apr 2026
Llama 3.3 70B131,072Workhorse fine-tune

๐ŸŸฃ Mistral AI

ModelContextCatatan
Mistral Large 2512262,144Flagship multilingual
Mistral Small 3.2 24B256,000Efisien & cepat
Codestral 2508256,000Khusus coding
Ministral 14B262,144Edge / mobile
Ministral 3B131,072Ultra-ringan
Mixtral 8x22B65,536MoE classic
Voxtral Small 24B32,000Voice-first model

๐ŸŒŠ DeepSeek

Gebrakan dari China โ€” V4 Flash $0.14 / $0.28 per M token! Peringkat #6 global.

ModelContextInput/1MOutput/1MSpeed
DeepSeek V4 Flash BEST VALUE1,000,000$0.14$0.28107.9 t/s
DeepSeek V4 Pro1,000,000$0.435$0.87174.9 t/s
DeepSeek R1 (Reasoning)163,840$0.70$2.50โ€”
DeepSeek V3.2163,840$0.27$0.40โ€”

โšซ xAI โ€” Grok

ModelContextCatatan
Grok 4.202,000,000Context window TERBESAR di dunia
Grok 4.20 Multi-Agent2,000,000Multi-agent mode
Grok 4.31,000,000Standar
Grok 4.5500,000Latest alias

๐Ÿ”ด China Players

Alibaba โ€” Qwen

ModelArchitectureContext
Qwen3 235B-a22BMoE (22B aktif)262,144
Qwen3 32BDense131,072
Qwen3 CoderMoE/Dense262K โ€“ 1M
Qwen PlusAPI flagship1,000,000

Moonshot โ€” Kimi

ModelContextInput/1MSpeedCatatan
Kimi K2.6256,000$0.95342.6 t/s#5 global HLE (54%)
Kimi K2.5128,000$0.55337.7 t/sVersi sebelumnya

Zhipu โ€” GLM

ModelContextInput/1MSpeedCatatan
GLM 5.21,000,000$0.95347 t/s#4 global HLE

MiniMax & ByteDance

CompanyModelContextInput/1M
MiniMaxM31,048,576$0.60
ByteDanceSeed 2.0 Lite262,144โ€”
ByteDanceSeed 1.6 Flash262,144$0.075

๐ŸŸฃ Nous Research โ€” Hermes Ecosystem

Lab AI open-source โ€” bikin Hermes Agent, Hermes Models, Nous Portal.

Hermes Agent ๐Ÿง 

FiturDetail
LisensiMIT โ€” 100% open source
GitHub219k stars ยท 41.5k forks
Learning LoopMemory system, Skills, Session Search โ€” otomatis belajar
PlatformCLI + 20+ platform (Telegram, Discord, WhatsApp, Signal, Teams, Email, SMS, dll)
TerminalLocal, Docker, SSH, Daytona, Modal, Singularity
Tools60+ built-in tools + MCP integration
DelegationSubagents parallel, programmatic tool calling
SmartCron jobs, Voice Mode, SOUL.md, Context Files

Nous Portal ๐Ÿ”Œ

One subscription โ†’ 300+ model + Tool Gateway (web search, image gen, TTS, browser). Gak perlu kumpulin API keys.

Hermes Models (HuggingFace)

ModelParamsDownloads
Hermes-4-14B14B194k+
Hermes-3-Llama-3.1-405B405Bโ€”
Hermes-4-405B / 70B405B / 70Bโ€”
Hermes-3-Llama-3.1-8B8B462k+
Nous-Hermes-2-Mixtral-8x7B-DPO8x7B MoE38k+
Hermes-4.3-36B36B10k+

๐Ÿ’ก Token System di Hermes


๐Ÿ“ฆ Other Players

Cohere

Command-A

256K ctx, $2.50/$10.

Amazon Nova

Pro/Lite/Micro

Micro $0.035/$0.14. Premier 1M ctx.

Perplexity Sonar

Pro/Deep Research

Search & research specialist.

Microsoft Phi-4

14B

16K ctx. Small & kompeten.

Inflection-3

Pi

Personal AI, 8K ctx.

AI21 Jamba

Large 1.7

256K ctx, SSM-Transformer hybrid.


๐Ÿ”ค Tokenizers & Token System

Apa Itu Token?

Token adalah unit dasar teks yang diproses model AI. Model tidak membaca huruf atau kata โ€” mereka membaca token. Ibarat "LEGO" bahasa.

Contoh tokenization (tiktoken):
"Halo, apa kabar?" โ†’ [Halo] [,] [ apa] [ kab] [ar] [?] = 6 token

๐Ÿงฎ Konversi

HubunganKira-kira
1 token โ‰ˆ0.75 kata (English)
1 token โ‰ˆ4 karakter
1 halaman buku โ‰ˆ660 token
Novel (100k kata) โ‰ˆ130.000 token

โš™๏ธ Jenis Tokenizer

TokenizerModelCara Kerja
BPEGPT, Claude, Llama, DeepSeek, QwenKarakter โ†’ gabung pasangan tersering โ†’ ulang
WordPieceBERTMirip BPE tapi likelihood-based merging
UnigramXLNet, T5Mulai banyak subword โ†’ pruning jarang dipakai
SentencePieceLlama 2/3, Gemma, T5Training tanpa pre-tokenized text

๐Ÿ“Š Vocabulary Size

ModelVocab SizeTokenizer
GPT-4o / GPT-5~100,000tiktoken (o200k_base)
Claude~100,000BPE custom
Llama 3 / 4128,000BPE (tiktoken-compatible)
Gemini / Gemma256,000SentencePiece
Mistral32,000BPE (SentencePiece)
Qwen3152,064BPE (tiktoken-based)

๐ŸŒ Token Efficiency per Bahasa

BahasaToken / 100 kata
English~133 โœ… Paling efisien
Bahasa Indonesia~145 โœ… Mendekati English
Mandarin~250-350 โŒ 2-3x lebih boros
Jepang~300-400 โŒ Paling boros

๐Ÿ’ก AI dalam Bahasa Indonesia relatif murah dibanding Mandarin/Jepang!


๐Ÿ’ฐ Perbandingan Harga Lengkap

#ModelInputOutputContextValue
1DeepSeek DeepSeek V4 Flash$0.14$0.281Mโญโญโญโญโญ
2Google Gemini 3.1 Flash Lite$0.25$1.501Mโญโญโญโญโญ
3Google Gemini 3 Flash$0.50$31Mโญโญโญโญ
4MiniMax MiniMax M3$0.60$2.401Mโญโญโญโญโญ
5Zhipu GLM 5.2$0.95$31Mโญโญโญโญโญ
6Moonshot Kimi K2.6$0.95$4256Kโญโญโญโญโญ
7OpenAI GPT-5.6 Luna$1$61.05Mโญโญโญโญ
8Google Gemini 3.5 Flash$1.50$91Mโญโญโญโญ
9Google Gemini 3.1 Pro$2$121Mโญโญโญโญ
10OpenAI GPT-5.6 Terra$2.50$151.05Mโญโญโญ
11Anthropic Claude Sonnet 5$3$151Mโญโญโญ
12Anthropic Claude Opus 4.8$5$251Mโญโญโญ
13OpenAI GPT-5.6 Sol$5$301.05Mโญโญโญ
14Anthropic Claude Mythos 5$10$501Mโญโญ
15Anthropic Claude Fable 5$10$501Mโญโญ
16OpenAI GPT-5.5 Pro$30$1801Mโญ

๐Ÿ’ก Best Value: DeepSeek V4 Flash ($0.14/$0.28). ๐Ÿš€ Fastest: GLM 5.2 (347 t/s). ๐Ÿ† Top Quality: Claude Mythos 5.


๐Ÿ“ฐ AI News & Trends โ€” Juli 2026

๐Ÿ”ฅ 1. Claude Dominasi Semua Benchmark

Mythos 5 juara HLE (64.5%), SWE-Bench (95.5%), AutoBench, OSWorld, BrowseComp, Terminal-Bench. Pertama kali satu perusahaan menang di hampir semua kategori.

โšก 2. Era 1M+ Context Window

Hampir semua flagship punya 1M+ context. Grok 4.20 bahkan 2M. DeepSeek V4 Flash 1M cuma $0.14/M input โ€” demokratisasi long-context.

๐Ÿ‡จ๐Ÿ‡ณ 3. China Rising

GLM 5.2 #4, Kimi K2.6 #5, DeepSeek V4 Flash #6 โ€” China mendominasi value-for-money. Harga super murah dengan performa global.

๐Ÿงช 4. AI Agents โ†’ Produksi Massal

Claude Cowork, Claude Code, OpenAI Codex, Hermes Agent โ€” semua bergerak ke autonomous agents. Computer Use, Terminal Use, Browsing jadi fitur wajib.

๐Ÿ”ฌ 5. Interpretability Breakthrough dari Anthropic

Anthropic menemukan "global workspace" di Claude โ€” sistem internal yang mirip kesadaran kerja. Model bisa menyimpan internal thoughts yang tidak muncul di output. Langkah besar menuju AI transparan.

๐Ÿ’ฐ 6. Harga Makin Kompetitif

Dari $180/M output (GPT-5.5 Pro) sampai $0.14/M input (DeepSeek V4 Flash) โ€” selisih 1.285x. Model murah sekarang sudah sangat capable.

๐Ÿ—๏ธ 7. MoE Jadi Standar

Qwen3 235B-a22B, Gemma 4 26B-a4B, Mixtral โ€” hanya sebagian parameter aktif per inference. Efisien tanpa korbankan kualitas.


๐Ÿ“– Glossary

Token
Unit dasar teks yang diproses model AI. Bisa kata, subword, atau karakter.
Context Window
Jumlah maksimal token yang bisa diproses model dalam satu sesi.
Tokenizer
Algoritma yang mengubah teks jadi token. Setiap model punya tokenizer sendiri.
BPE (Byte-Pair Encoding)
Tokenizer paling populer (GPT, Claude, Llama). Mulai dari karakter โ†’ gabung pasangan tersering.
MoE (Mixture of Experts)
Arsitektur dengan banyak "expert" subnetworks. Hanya beberapa aktif per token.
HLE (Humanity's Last Exam)
Benchmark tersulit untuk AI โ€” pertanyaan yang bahkan ahli manusia sulit jawab.
SWE-Bench
Benchmark coding agen โ€” model harus selesaikan PR/bug fix di repo nyata.
TTFT (Time to First Token)
Waktu dari request sampai token pertama diterima. Ukuran latensi.
t/s (tokens per second)
Kecepatan output model โ€” token per detik.
Reasoning Model
Model yang "berpikir" dulu sebelum jawab (chain-of-thought internal).
Fine-tuning
Melatih ulang model dengan data spesifik untuk domain tertentu.
DPO (Direct Preference Optimization)
Teknik fine-tuning tanpa RLHF kompleks, bikin model sesuai preferensi manusia.
Quantization
Mengompresi model (16-bit โ†’ 4-bit). Ukuran turun 4x, kecepatan naik.

๐Ÿ”ฌ AI Ecosystem 2026 โ€” Riset oleh Hermes Agent (Belajar AI Profile)

Sumber: Vellum LLM Leaderboard, OpenAI, Anthropic, GitHub NousResearch, HuggingFace, OpenRouter

๐Ÿ“… 23 Juli 2026 | 15+ perusahaan, 200+ model

๐Ÿ’ก Hermes Agent-mu sendiri adalah produk Nous Research โ€” AI yang belajar dari pengalaman ๐Ÿ”„

โ—€
Sebelumnya
Sesi 0: Sejarah AI
๐Ÿ  Beranda
Selanjutnya
Sesi 2: Praktik Langsung
โ–ถ
๐Ÿ  0 1 2 3 4