First Agent for Beginner
พื้นฐาน
AI Agent
สิ่งที่ต้องรู้ก่อนเริ่มใช้งานจริง

จากแนวคิด → เครื่องมือ → ความปลอดภัย → ระบบนิเวศ
ครบทุกคำศัพท์ที่จะเจอในวันแรกของการใช้ Agent

คนทำงานร่วมกับ AI Agent
ภาพใหญ่
แชทตอบ Agent ทำ
ตัวอย่างเห็นภาพ

บรีฟเดียว: "สรุปยอดขาย Excel 12 ไฟล์ ทำเป็นสไลด์พร้อมกราฟ"

Workflow Excel to slides
งานเดียวกันถ้าทำมือผ่านแชท: อัปโหลดทีละไฟล์ + copy-paste + เปิด PowerPoint เอง ≈ 2 ชั่วโมง — Agent เหลือหน้าที่เดียวให้คุณ: เปิดดูแล้วสั่งแก้
องค์ประกอบ
3 อย่างที่ทำให้เป็น Agent
โมเดล AI เป็น "สมอง" เหมือนกันทั้งแชทและ Agent — ต่างกันที่ มือ (Tools) กับ วงจรทำงาน (Loop)
ลงเครื่อง

เครื่องมือพื้นฐาน 2 ตัว

  • Node.js = ไฟฟ้า — ตัวรัน JavaScript ในเครื่อง Agent (Claude Code) รันบนมัน · เจอ npm / npx = เครื่องมือโลก Node · ลงครั้งเดียวจาก nodejs.org
  • Git = เครื่องย้อนเวลา — บันทึกเวอร์ชันเป็นจุด ๆ (commit = save point) ย้อนกลับได้ทุกเมื่อ
  • GitHub = คลาวด์ + ตลาดกลางของ skills/plugins — โหลดของฟรีมาต่อยอด
"ลง Node เพื่อให้ Agent เกิด — ใช้ git เพื่อให้ Agent ทำงานแล้วเราไม่เสียวสันหลัง"
Node.js และ Git
1 โปรเจกต์ = 1 โฟลเดอร์
ลงเครื่อง

Folder = โต๊ะทำงานของ Agent

  • เปิด Agent ที่โฟลเดอร์ไหน มันเห็นแค่นั้น — อ่าน/แก้/สร้างไฟล์ในขอบเขตนั้น
  • 1 โปรเจกต์ = 1 โฟลเดอร์ เช่น ~/Projects/report-Q3/
  • เปิดกว้างเกิน (ทั้ง Desktop) = สับสน + เสี่ยง / เปิดแคบพอดี = โฟกัส + ปลอดภัย
  • ประวัติแชท memory ตั้งค่า ผูกกับโฟลเดอร์ — เปิดที่เดิม = ทำงานต่อเนื่อง
สมองและเชื้อเพลิง

Model · Effort · Token · Context Window · API Key
— ทุกอย่างที่กำหนด "คุณภาพ vs ค่าใช้จ่าย"

คุมบังเหียน

Permission Modes — ระดับการคุม Agent

ก่อนทำอะไรที่มีผลจริง Agent จะ "ขออนุญาต" — แต่ละค่ายให้เลือกคนละจำนวนโหมด

Claude Code — 5 โหมด
โหมดพฤติกรรม
AutoDefaultClaude ตัดสินเรื่องสิทธิ์ให้เอง — จุดเริ่มต้นที่แนะนำ
Manualถามทุกครั้งก่อนจะแก้อะไร
Accept editsรับการแก้ไฟล์ให้อัตโนมัติทั้งหมด คำสั่งอื่นยังถาม
Planวางแผนให้ดูก่อน ยังไม่ลงมือแก้
Bypass permissions ⚠️ผ่านทุกสิทธิ์ ไม่ถามเลย
Codex — 3 โหมด
โหมดพฤติกรรม
Ask for approvalถามเสมอ ก่อนแก้ไฟล์นอกโปรเจกต์ และก่อนใช้อินเทอร์เน็ต
Approve for meถามเฉพาะ action ที่ระบบตรวจว่าอาจไม่ปลอดภัย
Full access ⚠️เข้าถึงอินเทอร์เน็ตและทุกไฟล์ในเครื่องได้ไม่จำกัด
แนวคิดเดียวกันทุกค่าย — เริ่มที่โหมดที่ยังถามก่อนเสมอ → ผ่อนเมื่อไว้ใจ → Bypass / Full access = ถอดเข็มขัดนิรภัย ต้องรู้ว่ากำลังทำอะไร
สมองและเชื้อเพลิง

Model — สมองที่เลือกได้ (Claude ↔ Codex)

ClaudeCodex (OpenAI)ความเก่งความเร็วโทเคน/เครดิตงานที่เหมาะ
Fable 5.1GPT-6 Astraเรือธงช้าที่สุดสูงที่สุดงานหินจริง — คิดยาวหลายขั้น · Agent เดินงานต่อเนื่องข้ามชั่วโมง
Opus 5GPT-5.6 Solสูงมากช้าสูงงานยาก คลุมเครือ วิเคราะห์ลึก โค้ดซับซ้อน งานที่ต้องเนี้ยบ
Sonnet 5GPT-5.6 Terraสูงปานกลาง–เร็วปานกลางตัวหลักงานประจำวัน — คุ้มสุดของทั้งสองค่าย
Haiku 4.5GPT-5.6 Lunaปานกลาง–สูงเร็วที่สุดต่ำมากงานชัดเจน ทำซ้ำจำนวนมาก สรุป แยกข้อมูล แก้โค้ดง่าย ๆ
—GPT-5.5 (รุ่นก่อน)≈ Lunaปานกลาง–ช้าสูงมากยังใช้ได้กับ implementation/debug/research — แต่ตระกูล 5.6 คุ้มกว่า
Fable 5.1 — ใช้เมื่อไหร่

งานที่ ผิดแล้วแพง · โจทย์ที่ Opus 5 ทำแล้วยังไม่ผ่าน · ปล่อยให้ Agent เดินงานยาวหลายขั้นเองโดยไม่ต้องจับมือ

เงื่อนไขที่ต้องรู้ ⚠️

คิดเสมอ ปิดไม่ได้ (คุมความลึกด้วย Effort แทน) · ต่อ token แพงกว่า Opus 5 ราว 2 เท่า · รอบเดียวอาจนานหลายนาที — นั่นคือมันกำลังคิด ไม่ใช่ค้าง

สมองและเชื้อเพลิง

Effort — ระดับความ "คิดนาน"

นอกจากเลือกสมอง ยังตั้งได้ว่าให้มัน "ครุ่นคิด" แค่ไหนก่อนตอบ

L
Low — ตอบไว ไม่คิดมาก
งาน mechanical เช่น เปลี่ยนชื่อไฟล์ 50 ไฟล์, จัดโฟลเดอร์
M
Medium — ค่าตรงกลาง
งานทั่วไปส่วนใหญ่ ใช้ค่านี้ได้เลย
H
High — คิดในใจนานขึ้น
งานที่ผิดแล้วแพง เช่น ออกแบบโครงสร้าง, วิเคราะห์ตัวเลขสำคัญ
Effort สูง = ช้าลง + เปลือง token คิดมากขึ้น — อีกปุ่มของสมการ คุณภาพ vs ค่าใช้จ่าย คู่กับการเลือก Model
Effort ระดับความคิดนาน
สมองและเชื้อเพลิง

Token — หน่วยเงิน + หน่วยความจำ

  • Token คือชิ้นส่วนข้อความที่โมเดลอ่าน/เขียน — ทุกอย่างที่ Agent เห็นและตอบ นับเป็น token หมด
  • บทบาทที่ 1 — ค่าใช้จ่าย: จ่ายตาม token เข้า+ออก โมเดลใหญ่แพงกว่าต่อ token
  • บทบาทที่ 2 — ความจำ: token คือหน่วยนับของ context window ต่อ session
Agent วนหลายรอบ (อ่าน → คิด → ทำ → เช็ค) = กิน token มากกว่าแชทหลายเท่า → ต้องตั้งงบและเลือกโมเดลให้เป็น
Token = หน่วยเงิน + หน่วยความจำ
สมองและเชื้อเพลิง

Context Window — ความจำระยะสั้น

ทุกอย่างที่โมเดล "เห็น" ได้ขณะตอบ 1 ครั้ง — โต๊ะทำงานที่พื้นที่จำกัด

  • กินพื้นที่: กติกา + บทสนทนา + ไฟล์ที่อ่าน (ตัวกินหลัก) + ความคิด + คำตอบ
  • ~200K token ≈ หนังสือ 500 หน้า — งาน Agent จริงหมดได้ในไม่กี่ชั่วโมง
  • ใกล้เต็ม → ระบบ ย่อความเก่า (compaction) รายละเอียดช่วงแรกอาจหาย
อาการ "Agent เริ่มลืมข้อตกลงตอนต้น" = ผลของการย่อความ ไม่ใช่โมเดลโง่ลง
Context Window
สมองและเชื้อเพลิง

ทางแก้: ความจำถาวรด้วยไฟล์ .md

Context Window = โต๊ะ

ชั่วคราว — จบ session = หาย
ควบคุมได้แค่ว่าจะวางอะไรบนโต๊ะ

ไฟล์ .md / Memory = ตู้

ถาวร — เขียนลงดิสก์ เปิด session ใหม่ก็อ่านกลับมาได้ครบ สดใหม่

ลงเครื่อง

ไฟล์คู่มือที่ Agent อ่านเองทุกครั้ง (CLAUDE.md ↔ AGENTS.md)

วางไว้ที่ไหนClaude CodeCodex
ส่วนตัว — ใช้ทุกโปรเจกต์~/.claude/CLAUDE.md~/.codex/AGENTS.md
ในโฟลเดอร์โปรเจกต์CLAUDE.mdAGENTS.md
  • คนละชื่อไฟล์ แต่แนวคิดเดียวกัน — ไฟล์ .md ธรรมดาที่ Agent อ่านเองก่อนเริ่มงาน ไม่ต้องสั่งซ้ำทุก session
  • ตัวในโฟลเดอร์โปรเจกต์ ทับ ตัวส่วนตัว — กติกาเฉพาะงานชนะเสมอ
  • เขียนสั้น กระชับ — ถูกโหลดทุก session กิน context ถาวร
  • ใช้ทั้งสองค่าย: เขียนเนื้อหาจริงไว้ไฟล์เดียว อีกไฟล์ใส่บรรทัดเดียวว่า อ่าน AGENTS.md — ไม่ต้องดูแลสองชุด
ไฟล์คู่มือ = นิสัย · Skill = ทักษะอาชีพ (เจอกันในหมวดระบบนิเวศ)
# CLAUDE.md / AGENTS.md ตัวอย่าง ## โปรเจกต์นี้คืออะไร รายงานยอดขายรายไตรมาส ทีมการตลาด ## กติกา - ตอบภาษาไทยเสมอ - เอกสารใช้ฟอนต์ Sarabun - ห้ามแก้ไฟล์ใน /raw-data โดยไม่ถาม ## สไตล์งาน - สรุปสั้น ตัวเลขต้องมีที่มา
Skill = สูตรงานสำเร็จรูป
ลงเครื่อง

Skill — สูตรงานสำเร็จรูป

  • โฟลเดอร์ที่มี SKILL.md บรรจุ "วิธีทำงานชนิดหนึ่ง" — เขียนครั้งเดียว ใช้ซ้ำตลอด
  • เรียกด้วย /ชื่อskill หรือ Agent หยิบเองเมื่องานเข้าเงื่อนไข
  • ตัวอย่าง: skill ทำเอกสาร Word, ทำสไลด์, เจนภาพตาม CI แบรนด์ (บรีฟ CI ครั้งเดียวจบ)
CLAUDE.md = นิสัย · Skill = ทักษะอาชีพ
ลงเครื่อง · 🆚

ไฟล์ .md vs Skill — ต่างกันยังไง

.md = ความจำ/กติกา (บอกว่า "เป็นยังไง") · Skill = สูตรทำงาน (บอกว่า "ทำยังไง") — ใช้คู่กัน ไม่ใช่แทนกัน

ไฟล์ .md (CLAUDE.md / โน้ต)Skill (SKILL.md + โฟลเดอร์)
บทบาทนิสัย กติกา ความจำของโปรเจกต์ทักษะอาชีพ — วิธีทำงานชนิดหนึ่งแบบครบสูตร
ถูกโหลดเมื่อไหร่CLAUDE.md โหลดทุก session อัตโนมัติ (กิน context ตลอด)โหลดเฉพาะเมื่อถูกเรียก (/ชื่อskill หรืองานเข้าเงื่อนไข)
เนื้อหาข้างในข้อความสั้น ๆ: โปรเจกต์คืออะไร กติกา สไตล์ ข้อห้ามขั้นตอนละเอียด + ไฟล์แนบได้ (เทมเพลต, ภาพตัวอย่าง, สคริปต์)
ขอบเขตผูกกับโฟลเดอร์/เครื่อง (user-level หรือ project-level)ใช้ข้ามโปรเจกต์ได้ แชร์ต่อให้คนอื่นได้
ตัวอย่าง"ตอบภาษาไทยเสมอ ห้ามแก้ /raw-data""วิธีทำสไลด์ ZenityX ครบทุกขั้น + เทมเพลต"
จำง่าย ๆ: อยากให้ Agent "จำ" → เขียน .md · อยากให้ Agent "ทำเป็น" → สร้าง Skill
คุมบังเหียน

ใช้ Agent ยังไงให้ปลอดภัย

ไม่ต้องรู้เรื่องเทคนิค — จำแค่ 3 ข้อนี้ ทำทุกครั้งก็พอ

ก๊อปไฟล์เก็บไว้อีกชุดก่อนเริ่ม

ให้ Agent ทำกับตัวก๊อป ส่วนตัวจริงเก็บไว้อีกที่ — ถ้ามันทำพัง ก็แค่ก๊อปมาใหม่

อ่านก่อนกดตกลงทุกครั้ง

ตอนมันขออนุญาต ดูก่อนว่ามันจะทำอะไรกับไฟล์ไหน โดยเฉพาะเวลาเห็นคำว่า ลบ หรือ เขียนทับ

เก็บรหัส (key) ให้ดีเหมือนบัตรเครดิต

ไม่ส่งให้ใคร ไม่แปะในแชท และตั้งเพดานเงินไว้ก่อนเสมอ — หายก็ยกเลิกแล้วขออันใหม่ได้

ใช้ Agent อย่างปลอดภัย
ระบบนิเวศ

Capabilities — ความจำข้าม Session

ความสามารถเสริมระดับแอป เปิด/ปิดได้ในตั้งค่า — แก้โรค "ความจำเสื่อมทุกครั้งที่เปิดใหม่"

Search and reference chats

ค้น "แชทเก่า" ของคุณได้ — เช่น "โปรเจกต์นี้เคยคุยเรื่องราคาไว้ว่ายังไง" → ดึงจาก session ก่อนมาอ้างอิง ไม่ต้องเล่าใหม่

Generate memory from history

สกัด "ข้อเท็จจริงถาวร" จากบทสนทนา (คุณเป็นใคร ชอบสไตล์ไหน งานอะไรค้าง) เก็บเป็น memory อัตโนมัติ — session ใหม่ก็จำคุณได้

API Key = กุญแจ + บัตรเครดิต
สมองและเชื้อเพลิง · 🔑

API Key คืออะไร

รหัสประจำตัว + บัตรเครดิต ในสตริงเดียว — บอกผู้ให้บริการว่า "คำขอนี้มาจากใคร และเก็บเงินใคร"

# หน้าตาของ API key sk-ant-api03-Xq7fK2mNp...ยาว ~100 ตัวอักษร
เปรียบ: กุญแจห้องพัก + บัตรรูดค่าใช้จ่ายในตัว — ทำหาย ไม่ใช่แค่เข้าห้องไม่ได้ แต่คนเก็บได้เอาไปรูด
สมองและเชื้อเพลิง · 🔑
Agent ใช้ API Key ตรงไหนบ้าง
"ต่อ API แบบไม่เขียนโค้ด" = วาง key ในที่ที่ Agent หยิบใช้เองได้ (env / config) — วางครั้งเดียว จบ
ระบบนิเวศ

Connectors (MCP) — เสียบปลั๊กโลกภายนอก

  • มาตรฐานชื่อ MCP (Model Context Protocol) — "พอร์ต USB ของ AI"
  • เชื่อมแล้ว Agent ได้ เครื่องมือชุดใหม่: Google Drive, Slack, Notion, ฐานข้อมูล, API เจนภาพ/วิดีโอ
  • ไม่ต้องเขียนโค้ด — กด connect / login ครั้งเดียว ใช้ได้เหมือนเครื่องมือในตัว
  • ระวัง: connector = ประตูสู่ข้อมูลจริง → เชื่อมเฉพาะที่เชื่อถือได้
MCP = พอร์ต USB ของ AI
ระบบนิเวศ · 🆚
API Key ตรง vs MCP
กติกามือใหม่: มี MCP → ใช้ MCP ก่อนเสมอ / ไม่มี หรือต้องการเกินเมนู → ค่อยลง key ตรง · MCP บางตัวก็ใช้ key ข้างใน แต่กรอกครั้งเดียวแล้วมันจัดการต่อให้
สรุป

แผนที่ความจำ + Checklist ก่อนใช้จริง

โฟลเดอร์ = โต๊ะทำงาน Model + Effort = สมอง + ความตั้งใจ Token = ค่าแรง/สมาธิที่จำกัด .md / Memory = สมุดบันทึกถาวร API Key = พวงกุญแจ + บัตรเครดิต Permission = ระดับอิสระที่ให้ Skill = สูตรที่ฝึกแล้ว Connector/Plugin = ปลั๊กเสริม / แพ็กรวม
ลง Node.js + git
สร้างโฟลเดอร์โปรเจกต์
เขียน CLAUDE.md สั้น ๆ
ตั้ง API key + spending limit
เริ่มที่ Default mode
พร้อมแล้ว — ไปสร้าง Agent ตัวแรกกัน 🚀
← → เลื่อนสไลด์ · F เต็มจอ
1 / 24 · ZenityX