
เริ่มจาก Frontier AI — ChatGPT · Gemini · Grok · Claude แล้วลงมือทำ Local AI บนเครื่องของคุณเอง — Ollama · Hermes · ComfyUI

ChatGPT · Gemini · Grok · Claude — อัพเดตรุ่นและฟีเจอร์ล่าสุดถึง สิงหาคม 2026





โมเดลปิดระดับแนวหน้า 4 ค่าย — ปี 2026 ทุกค่ายรวม reasoning + multimodal + agent ไว้ในตัว

OpenAI
GPT-5.6ผู้ใช้ ~1 พันล้าน/สัปดาห์ · ecosystem ใหญ่สุด

Google DeepMind
3.1 Pro · 3.7 Flashmultimodal เนทีฟ + ผูก Google + Nano Banana

xAI
Grok 4.6ข้อมูลสดจาก X + ราคาถูกในกลุ่ม frontier

Anthropic
Claude 5 · Opusเก่งโค้ด + agent + เน้นความปลอดภัย
แนวโน้ม 2026: reasoning ในตัว · multimodal ครบ (ข้อความ·ภาพ·เสียง·วิดีโอ) · agent ทำงานหลายขั้นแทนเรา · context ระดับล้าน token





ข้อมูล ณ สิงหาคม 2026 — ตัวเลขและราคาปรับเปลี่ยนได้ตลอด
| ChatGPT | Gemini | Grok | Claude | |
|---|---|---|---|---|
| ผู้พัฒนา | OpenAI | xAI | Anthropic | |
| รุ่นล่าสุด | GPT-5.6 | 3.1 Pro · 3.7 Flash | Grok 4.6 | Claude 5 · Opus |
| Context | ~1M | 1M – 2M | 500K | 1M |
| จุดเด่น | ผู้ใช้เยอะ + ปลั๊กอิน | multimodal + Google | เรียลไทม์ X + ถูก | โค้ด + agent + ปลอดภัย |
| ภาพ / วิดีโอ | Images · Sora 2 | Nano Banana 2 · Veo | Imagine (Aurora) | ผ่านเครื่องมือ/MCP |
| เสียง | Advanced Voice | Gemini Live | Grok Voice (clone) | ผ่าน API |
| เหมาะกับงาน | แชตทั่วไป + ปลั๊กอิน | งานเอกสาร Google | ข่าวสด + งบน้อย | เขียนโค้ด + งาน agent |
เลือกใช้: งานโค้ด/agent → Claude · งานเอกสาร Google → Gemini · แชตทั่วไป → ChatGPT · ข่าวสด+ประหยัด → Grok · ข้อมูลลับห้ามออกเครื่อง → Local AI (ช่วงถัดไป)

ค่าย frontier แข่งกันด้าน generative media — ตัวอย่างภาพจากโมเดลชั้นนำปี 2026

Google · 4K + ตัวอักษร
↗ ลองเลย
OpenAI · ทำตาม prompt แม่น
↗ ลองเลย
สาย art / aesthetic
↗ ลองเลย
open-weight · ComfyUI
FLUX · SD 3.5 · Qwen-Image (ช่วง Local AI)
Veo · Kling · Suno · ElevenLabs และอื่นๆ พร้อมลิงก์ลองใช้ — หน้าถัดไป →

สร้างวิดีโอ · เพลง · เสียงพากย์ ระดับโปรบนคลาวด์ — คลิกการ์ดเพื่อเปิดใช้งานจริง

วิดีโอ 4K + เสียงในตัว
↗Kimage→video คมชัด
↗
สร้างวิดีโอในแอป Grok

จาก Frontier บนคลาวด์ — มาสู่ AI ที่รันในเครื่องเราเอง: ส่วนตัว · ประหยัด · ควบคุมได้ · ออฟไลน์ได้

ปี 2026 โมเดลคุณภาพสูงรัน บนเครื่องเราเอง ได้แล้ว — 4 เหตุผลที่ควรย้ายมา Local AI

ข้อมูลไม่ออกเครื่อง · PDPA-safe

จ่าย ครั้งเดียว ไม่มีรายเดือน

เลือก/ปรับโมเดลเอง ไม่จำกัด

ไม่ต้องต่อเน็ต ไม่มี downtime

4 เครื่องมือหลัก แบ่งเป็น 2 ฝั่ง — ทุกตัวรันบนเครื่องเดียว
Ollama
Open WebUI
Hermes · UI จริง
ComfyUI
Krita AI
เหมือนมี ChatGPT ส่วนตัว อยู่ในเครื่อง — แชท ถาม-ตอบ เขียน สรุป แปล เขียนโค้ด ทั้งหมดรันออฟไลน์ ติดตั้งด้วยการคลิกไม่กี่ที
ollama run gemma4:e4b — โหลดครั้งเดียว ใช้งานบน NVIDIA RTX โดยไม่ต้องต่ออินเทอร์เน็ต พิมพ์ถามภาษาไทยได้เลย
ตัวเล็กเร็ว (3GB) จนถึง gpt-oss 20B / Qwen 35B — สลับได้ในคำสั่งเดียว
เป็น backend ให้ Open WebUI และ Hermes ต่อใช้งาน
Ollama · gemma4 บน NVIDIA RTX
Open WebUI — หน้าตาเหมือน ChatGPT แต่เป็นของคุณเองเปิดเบราว์เซอร์ → แชทได้เลย ไม่ต้องพิมพ์คำสั่ง
สลับโมเดล · เก็บประวัติ · อัปโหลดไฟล์ให้ AI อ่าน
หลายผู้ใช้ — ตั้งเครื่องเดียว ทั้งทีมเข้าใช้ผ่านเว็บ (เหมาะทีม/องค์กร)
ทำให้ Ollama "ใช้ง่ายเหมือน ChatGPT" — คนไม่ใช่สายเทคนิคก็ใช้เป็นทันที

เลือกตาม VRAM ของการ์ดจอ — ยิ่ง VRAM เยอะ = รันโมเดลใหญ่/ฉลาดกว่าได้
| โมเดล | ขนาด | เด่นเรื่อง | สเปคแนะนำ |
|---|---|---|---|
| Qwen 3.6 35B-A3B (MoE) | ~22 GB | tool-calling · ~168 tok/s | RTX 5090 · VRAM 32GB |
| Gemma 4 E4B / 12B / 31B | 3–18 GB | อเนกประสงค์ ไทยดี | RTX 5000-series · VRAM 8GB+ |
| gpt-oss 20B | ~13 GB | reasoning สูง | RTX 5080/5090 · VRAM 16GB+ |
| Typhoon 2 8B (SCB10x) | ~4.6 GB | 🇹🇭 ภาษาไทยดีสุด | RTX 5000-series · VRAM 8GB+ |
| Typhoon-OCR · GLM-OCR | 2–3 GB | อ่านเอกสารภาพไทย → ข้อความ | RTX 5000-series · VRAM 8GB+ |
เรือธงของ fleet — รัน LLM 35B, สร้างภาพทุก arch และวิดีโอ AI ได้ในเครื่องเดียว
💡 "เร็ว" กับ "ฉลาด" คนละเรื่อง — เลือกเครื่อง/โมเดลตามงาน

ตระกูลโมเดลภาษา open-weights จาก Alibaba — เก่งหลายภาษา (รวมภาษาไทย), reasoning และ tool-calling ดีมาก · โหลดมารันเองได้ฟรี
MoE (Mixture of Experts) = มี “ผู้เชี่ยวชาญ” หลายตัว แต่ละคำตอบเรียกใช้แค่ไม่กี่ตัว · A3B = active ~3B พารามิเตอร์ต่อครั้ง (จาก 35B ทั้งหมด)
💡 ฉลาดระดับ 35B แต่เร็ว/ประหยัดเท่าโมเดล 3B — จึงเหมาะเป็น “สมอง” ของเอเจนต์
➡️ Session 2 ถัดไป: Hermes ใช้ Qwen 3.6 ตัวนี้เป็นเครื่องยนต์ (ตรงกับที่ Gigabyte ระบุ “Qwen is used by Hermes”)

Agentic framework จาก Nous Research — always-on, จำได้ข้ามเซสชัน, ตั้งเวลาเองได้ คุยผ่าน LINE · Telegram · Discord ขับด้วยโมเดล Qwen ในเครื่อง

Hermes Desktop · UI จริง — สั่งงาน แล้วเอเจนต์ลงมือทำสร้าง/ปรับทักษะเอง
จำข้ามเซสชัน
ตั้งงานตามเวลา
ค้นเว็บ · เรียก ComfyUI
→ ส่งลิงก์ใน LINE "สรุป 5 bullet"
→ Cron 8 โมง รวม PR ค้าง ส่ง Discord
→ "ทำ thumbnail สีฟ้า" เรียก ComfyUI


⚠️ Hermes = agentic framework (open-source · MIT · Nous Research · ก.พ. 2026) — ไม่ใช่โมเดล · โมเดลที่ขับคือ Qwen 3.6 (ตรงกับที่ Gigabyte ระบุ “Qwen is used by Hermes”)

เขียน/ปรับ skill เองจากงานจริง

จำข้ามเซสชัน · SQLite FTS5

เว็บ · ไฟล์ · โค้ด · ตั้งเวลา

always-on ข้าม reboot

Ollama · vLLM · llama.cpp

RTX 5090 + Qwen 3.6 35B
📚 ที่มา (verified · adversarial 3-vote): Nous Research · NVIDIA RTX AI Garage — 2026








Hermes Desktop · UI จริง — "cut the release notes จาก commits ล่าสุด" → เขียนไฟล์ + เปิด PR #482งานซับซ้อน (~5+ tool calls) → บันทึกเป็น skill (ไฟล์ Markdown) · ปรับปรุงเองระหว่างใช้
USER.md / MEMORY.md + SQLite FTS5 + สรุปด้วย LLM → จำบริบทข้ามวันได้
ตั้งเวลา · terminal · ไฟล์ · เว็บ · browser automation · รันโค้ด

รันเป็น daemon always-on ข้าม reboot · เชื่อมทุกช่องทางแชต
+ WhatsApp · Signal · Email · CLI · *ช่องทางขึ้นกับ gateway plugin
เสิร์ฟโมเดลด้วย Ollama / LM Studio / llama.cpp / vLLM / SGLang — เช่น Qwen 3.6 35B บน RTX / DGX



คำถามสำคัญ: บน Hermes เดียว "ร่วมกัน" แบบไหนได้ — หลาย bot หรือหลาย คน?
Hermes Desktop · agents แยกตามโปรเจกต์ (hermes-agent · dataplatform · webapp · marketing…) + ไฟล์ & terminal ในตัว"These bots can be given jobs, descriptions, profile pics, and communicate with your other bots!"
แต่ละ bot มี role · model · memory · skills · รูป ของตัวเอง · protocol: 1 ข้อความ → สูงสุด 3 รอบ · cap 10 ข้อความ/ครั้ง · escalate หามนุษย์ด้วย @user
| รูปแบบร่วมงาน | ได้ไหม | ผ่านอะไร |
|---|---|---|
| หลาย bot ร่วมกัน (1 คนคุม) | ✅ ได้ | Bot Mode (native) |
| Agent ข้ามเฟรมเวิร์ก | ✅ ได้ | A2A v1.0 plugin |
| หลาย คน + AI ใน workspace เดียว | ◑ ต้องใช้ | Buzz (integration แยก) |
| หลายคน co-drive Hermes ตัวเดียว (shared session / SSO / admin) | ✗ ไม่มี | เป็น single-user tool |
workspace open-source ของ Block (Jack Dorsey) · self-hostable · คน & agent อยู่ channel/โค้ดเดียวกัน — แต่ละคน/agent = keypair บน relay ที่คุณ own
เชื่อม Hermes 3 ทาง: Buzz Desktop runtime · relay bridge · native gateway plugin · ⚠️ Buzz เป็นของ Block ไม่ใช่ Nous
"puts humans and agents in the same messaging channels and codebase"
งาน Arize Observe 2026 · พูดโดย Sam Herring (ML engineer, Nous Research) — เล่า Hermes Agent บน production จริง
⚠️ คลิปเดโม/รีวิวอื่นบน YouTube ยังบาง — แนะนำเปิดเช็ก title/ยอดวิว/วันที่ก่อนใช้จริง
github.com/NousResearch/hermes-agent · hermes-agent.nousresearch.com/docs · 🤗 huggingface.co/NousResearch
@Teknium · @NousResearch (X) · docs/user-guide/bot-mode · block.xyz/inside · github.com/block/buzz
openrouter.ai/nousresearch/hermes-4-405b · arXiv 2508.18255 · VentureBeat · MarkTechPost
ทุกข้อมูลผ่าน /deep-research + adversarial 3-vote verification · ตรวจ ส.ค. 2026

เครื่องยนต์ภาพแบบ ต่อบล็อก (node) ควบคุมได้ละเอียดสุด — Text→Image, Image→Video และเสียง TTS ครบในเครื่องเดียว
Workflow จริง — Z-Image Turbo · 8 steps · 1024×1024พิมพ์คำบรรยาย → ได้ภาพ · เลือก sampler, steps, seed เองได้
ภาพนิ่ง → คลิปเคลื่อนไหว (LTX-Video, Wan) + เสียง TTS
ลบของ เติมพื้นหลัง ขยายความละเอียด
| งาน | โมเดล | ประเภท |
|---|---|---|
| สร้างภาพเริ่มต้น | SDXL · Z-Image Turbo · Flux2 Klein | Image |
| ภาพระดับโปร | Flux1 Krea · Krea2 Turbo | Image |
| ภาพ→วิดีโอ | LTX-Video 2.3 · Wan 2.2 | Video |
| เสียงพากย์ | OmniVoice · Qwen TTS | Audio |
ภาพจริงจากเครื่อง local — Flux (fp4) บน RTX 5090ตัวอย่างจริงจาก ComfyUI — คลิปเล่นวนอัตโนมัติ รันบน RTX ในเครื่อง





โมเดลวิดีโอ open-source รันในเครื่อง — คลิปจริงจาก official ComfyUI examples
⭐ MiniMax H3 — สร้าง วิดีโอ + เสียง stereo ในพาสเดียว ความละเอียด 2K · 5 โหมด (text/image/first-last/reference→video) · day-0 ใน ComfyUI

แต่งเพลงจากคำบรรยาย + Foley (MMAudio) + TTS พากย์หลายภาษา


Hunyuan3D · TripoSR — เปิดใน Blender/เกม/เว็บ ได้ทันที หมุน 360°
ESRGAN + Ultimate SD Upscaleภาพเล็ก/เบลอ → คมชัด ×4–×8 · ต่อยอดได้ถึง 32K ด้วย Flux

| เครื่อง | VRAM | ทำอะไรได้ |
|---|---|---|
| RTX 5060 / 5060 Ti | 8 GB | ภาพ SDXL + LLM เล็ก ≤9B |
| RTX 5070 / 5060 Ti | 12–16 GB | + Flux/Krea2 · LLM ≤14B |
| RTX 5080 | 16 GB | ภาพระดับโปร เร็วสุดในกลุ่ม |
| RTX 5090 🚩 เรือธง | 32 GB | ทำได้ทุกอย่าง — LLM 35B + ภาพ + วิดีโอ AI + Hermes |
🚩 RTX 5090 · 32GB = เรือธง — เครื่องเดียวจบ: LLM 35B (~168 tok/s), ภาพทุก arch, วิดีโอ AI + เสียง

ยิ่ง VRAM เยอะ ยิ่งโหลด โมเดลใหญ่ / ฉลาดกว่า ได้
8GB → LLM ~8B · 16GB → ~14–20B · 32GB → 35B + วิดีโอ AI
CUDA Cores + Bandwidth ที่มากขึ้น = AI ตอบเร็วขึ้น (tok/s สูง)
Bandwidth 448 → 1,792 GB/s · CUDA 3,840 → 21,760

ทุกคนทำสำเร็จได้ แม้ไม่มีพื้นฐานเขียนโปรแกรม — ลงมือบนเครื่องตัวเอง

ollama.com/download

ollama run gemma4:e4b

ถามภาษาไทยได้ทันที

ยิงเข้า NVIDIA RTX 4 รุ่นที่เตรียมมา
ollama ps ดูว่าใช้ GPU หรือ CPU
📦 มีไฟล์ offline + โมเดล pre-download สำรอง WiFi

เวิร์คช็อปนี้รันบนเครื่อง GIGABYTE × NVIDIA RTX 50-Series — เลือกได้ตามงาน AI · ต่างกันที่ การ์ดจอ เป็นหลัก
| AI STARTERGIGAI_001 | AI CREATORGIGAI_002 | AI PROGIGAI_003 | AI FLAGSHIPGIGAI_004 | |
|---|---|---|---|---|
| 🖥️ การ์ดจอ NVIDIA | RTX 5060 TiEAGLE OC ICE |
RTX 5070WINDFORCE OC SFF |
RTX 5070WINDFORCE OC SFF |
RTX 5080AERO OC SFF |
| 🧠 VRAM (GDDR7) | 8 GB 128-bit |
12 GB 192-bit |
12 GB 192-bit |
16 GB 256-bit |
| โมเดล AI ที่รันได้ | LLM ~8B · SDXL | LLM ~14B · Flux.1 | LLM ~14B · Pipeline | LLM ~32B · Video AI |
| CPU | i7-14700F 20C/28T |
i7-14700F 20C/28T |
i9-14900K 24C/32T |
i9-14900K 24C/32T |
| เมนบอร์ด | B760M GAMING X | B760M GAMING X | Z790 EAGLE | Z790 EAGLE |
| ร่วมกันทุกรุ่น | แรม 32GB DDR5 5600 · SSD WD Blue SN5000 2TB NVMe Gen4 · ชุดน้ำ GIGABYTE 360 ICE · เคส C500 Panoramic Stealth ICE | |||

ollama.com
ติดตั้งครั้งเดียว
เล็ก → ใหญ่ · เลือกตาม VRAM
ollama run …
ไทย·อังกฤษ·จีน·ญี่ปุ่น·เกาหลี
ผู้เชี่ยวชาญเฉพาะทาง
ตัวติดตั้งตัวเดียว ~1.5 GB — ดับเบิลคลิกแล้วรอ ไม่ต้องตั้งค่าอะไรเพิ่ม
รันตัวติดตั้ง — OllamaSetup.exe
กำลังติดตั้ง · v0.33.2 (รวม CUDA)
เปิดครั้งแรก — Welcome to Ollamaเปิดใช้ทันทีกับ coding agent ยอดนิยม · ย้ายโฟลเดอร์โมเดลไปไดรฟ์ที่ว่างได้
เชื่อมแอปได้เลย — ollama launch …
Settings — บัญชี · เครือข่าย · context
เลือกที่เก็บโมเดล — Model location
เลือกโมเดล — local หรือ cloud (qwen3.8 · gemma · glm)
แชตไทยกับ qwen3.8 — “แนะนำตัวเองสิ” ตอบทันที รันในเครื่องให้โมเดลแนะนำตัวเอง — สลับภาษาได้ทันที ไม่ต้องต่อเน็ต

"คุณคือผู้เชี่ยวชาญ Cybersecurity — แนะนำการตั้งค่าระบบ Networking ให้ปลอดภัย"
รันในเครื่อง — ข้อมูลระบบไม่ออกเครื่อง
Krea 2
Krea 2
FLUX Krea
Qwen-Imageสร้างเร็ว ~15 วิ/ภาพ (1024px บน RTX 5090) · เหมาะเดโมสด
12B · ภาพเนียนเหมือนถ่ายจริง · official Comfy-Org checkpoints


สั่งงานเป็นภาษาคน → เอเจนต์เขียนโค้ด HTML/CSS/JS ให้เอง

LLM ในเครื่อง + Open WebUI
เลขา AI ในแชต (Qwen)
ภาพ + วิดีโอ + Krita AI
RTX 5090 · 32GB เรือธง
ทักษะ "สั่ง AI เป็น + รันเองได้" กำลังเป็นพื้นฐานของบัณฑิตทุกสาขา — เหมือน Excel เมื่อ 20 ปีก่อน

เปิดกล้องมือถือ → สแกน → เปิดหรือบันทึกสไลด์ได้ทันที · เก็บไว้ลองทำตามที่บ้าน