First Agent for Beginner
พื้นฐาน
AI Agent
สิ่งที่ต้องรู้ก่อนเริ่มใช้งานจริง
จากแนวคิด → เครื่องมือ → ความปลอดภัย → ระบบนิเวศ
ครบทุกคำศัพท์ที่จะเจอในวันแรกของการใช้ Agent
ตัวอย่างเห็นภาพ
บรีฟเดียว: "สรุปยอดขาย Excel 12 ไฟล์ ทำเป็นสไลด์พร้อมกราฟ"
งานเดียวกันถ้าทำมือผ่านแชท: อัปโหลดทีละไฟล์ + copy-paste + เปิด PowerPoint เอง ≈ 2 ชั่วโมง — Agent เหลือหน้าที่เดียวให้คุณ: เปิดดูแล้วสั่งแก้
องค์ประกอบ
โมเดล AI เป็น "สมอง" เหมือนกันทั้งแชทและ Agent — ต่างกันที่ มือ (Tools) กับ วงจรทำงาน (Loop)
ลงเครื่อง
เครื่องมือพื้นฐาน 2 ตัว
- Node.js = ไฟฟ้า — ตัวรัน JavaScript ในเครื่อง Agent (Claude Code) รันบนมัน · เจอ npm / npx = เครื่องมือโลก Node · ลงครั้งเดียวจาก nodejs.org
- Git = เครื่องย้อนเวลา — บันทึกเวอร์ชันเป็นจุด ๆ (commit = save point) ย้อนกลับได้ทุกเมื่อ
- GitHub = คลาวด์ + ตลาดกลางของ skills/plugins — โหลดของฟรีมาต่อยอด
"ลง Node เพื่อให้ Agent เกิด — ใช้ git เพื่อให้ Agent ทำงานแล้วเราไม่เสียวสันหลัง"
ลงเครื่อง
Folder = โต๊ะทำงานของ Agent
- เปิด Agent ที่โฟลเดอร์ไหน มันเห็นแค่นั้น — อ่าน/แก้/สร้างไฟล์ในขอบเขตนั้น
- 1 โปรเจกต์ = 1 โฟลเดอร์ เช่น ~/Projects/report-Q3/
- เปิดกว้างเกิน (ทั้ง Desktop) = สับสน + เสี่ยง / เปิดแคบพอดี = โฟกัส + ปลอดภัย
- ประวัติแชท memory ตั้งค่า ผูกกับโฟลเดอร์ — เปิดที่เดิม = ทำงานต่อเนื่อง
สมองและเชื้อเพลิง
Model · Effort · Token · Context Window · API Key
— ทุกอย่างที่กำหนด "คุณภาพ vs ค่าใช้จ่าย"
คุมบังเหียน
Permission Modes — ระดับการคุม Agent
ก่อนทำอะไรที่มีผลจริง Agent จะ "ขออนุญาต" — แต่ละค่ายให้เลือกคนละจำนวนโหมด
Claude Code — 5 โหมด
| โหมด | พฤติกรรม |
| AutoDefault | Claude ตัดสินเรื่องสิทธิ์ให้เอง — จุดเริ่มต้นที่แนะนำ |
| Manual | ถามทุกครั้งก่อนจะแก้อะไร |
| Accept edits | รับการแก้ไฟล์ให้อัตโนมัติทั้งหมด คำสั่งอื่นยังถาม |
| Plan | วางแผนให้ดูก่อน ยังไม่ลงมือแก้ |
| Bypass permissions ⚠️ | ผ่านทุกสิทธิ์ ไม่ถามเลย |
Codex — 3 โหมด
| โหมด | พฤติกรรม |
| Ask for approval | ถามเสมอ ก่อนแก้ไฟล์นอกโปรเจกต์ และก่อนใช้อินเทอร์เน็ต |
| Approve for me | ถามเฉพาะ action ที่ระบบตรวจว่าอาจไม่ปลอดภัย |
| Full access ⚠️ | เข้าถึงอินเทอร์เน็ตและทุกไฟล์ในเครื่องได้ไม่จำกัด |
แนวคิดเดียวกันทุกค่าย — เริ่มที่โหมดที่ยังถามก่อนเสมอ → ผ่อนเมื่อไว้ใจ → Bypass / Full access = ถอดเข็มขัดนิรภัย ต้องรู้ว่ากำลังทำอะไร
สมองและเชื้อเพลิง
Model — สมองที่เลือกได้ (Claude ↔ Codex)
| Claude | Codex (OpenAI) | ความเก่ง | ความเร็ว | โทเคน/เครดิต | งานที่เหมาะ |
| Fable 5.1 | GPT-6 Astra | เรือธง | ช้าที่สุด | สูงที่สุด | งานหินจริง — คิดยาวหลายขั้น · Agent เดินงานต่อเนื่องข้ามชั่วโมง |
| Opus 5 | GPT-5.6 Sol | สูงมาก | ช้า | สูง | งานยาก คลุมเครือ วิเคราะห์ลึก โค้ดซับซ้อน งานที่ต้องเนี้ยบ |
| Sonnet 5 | GPT-5.6 Terra | สูง | ปานกลาง–เร็ว | ปานกลาง | ตัวหลักงานประจำวัน — คุ้มสุดของทั้งสองค่าย |
| Haiku 4.5 | GPT-5.6 Luna | ปานกลาง–สูง | เร็วที่สุด | ต่ำมาก | งานชัดเจน ทำซ้ำจำนวนมาก สรุป แยกข้อมูล แก้โค้ดง่าย ๆ |
| — | GPT-5.5 (รุ่นก่อน) | ≈ Luna | ปานกลาง–ช้า | สูงมาก | ยังใช้ได้กับ implementation/debug/research — แต่ตระกูล 5.6 คุ้มกว่า |
Fable 5.1 — ใช้เมื่อไหร่
งานที่ ผิดแล้วแพง · โจทย์ที่ Opus 5 ทำแล้วยังไม่ผ่าน · ปล่อยให้ Agent เดินงานยาวหลายขั้นเองโดยไม่ต้องจับมือ
เงื่อนไขที่ต้องรู้ ⚠️
คิดเสมอ ปิดไม่ได้ (คุมความลึกด้วย Effort แทน) · ต่อ token แพงกว่า Opus 5 ราว 2 เท่า · รอบเดียวอาจนานหลายนาที — นั่นคือมันกำลังคิด ไม่ใช่ค้าง
สมองและเชื้อเพลิง
Effort — ระดับความ "คิดนาน"
นอกจากเลือกสมอง ยังตั้งได้ว่าให้มัน "ครุ่นคิด" แค่ไหนก่อนตอบ
L
Low — ตอบไว ไม่คิดมาก
งาน mechanical เช่น เปลี่ยนชื่อไฟล์ 50 ไฟล์, จัดโฟลเดอร์
M
Medium — ค่าตรงกลาง
งานทั่วไปส่วนใหญ่ ใช้ค่านี้ได้เลย
H
High — คิดในใจนานขึ้น
งานที่ผิดแล้วแพง เช่น ออกแบบโครงสร้าง, วิเคราะห์ตัวเลขสำคัญ
Effort สูง = ช้าลง + เปลือง token คิดมากขึ้น — อีกปุ่มของสมการ คุณภาพ vs ค่าใช้จ่าย คู่กับการเลือก Model
สมองและเชื้อเพลิง
Token — หน่วยเงิน + หน่วยความจำ
- Token คือชิ้นส่วนข้อความที่โมเดลอ่าน/เขียน — ทุกอย่างที่ Agent เห็นและตอบ นับเป็น token หมด
- บทบาทที่ 1 — ค่าใช้จ่าย: จ่ายตาม token เข้า+ออก โมเดลใหญ่แพงกว่าต่อ token
- บทบาทที่ 2 — ความจำ: token คือหน่วยนับของ context window ต่อ session
Agent วนหลายรอบ (อ่าน → คิด → ทำ → เช็ค) = กิน token มากกว่าแชทหลายเท่า → ต้องตั้งงบและเลือกโมเดลให้เป็น
สมองและเชื้อเพลิง
Context Window — ความจำระยะสั้น
ทุกอย่างที่โมเดล "เห็น" ได้ขณะตอบ 1 ครั้ง — โต๊ะทำงานที่พื้นที่จำกัด
- กินพื้นที่: กติกา + บทสนทนา + ไฟล์ที่อ่าน (ตัวกินหลัก) + ความคิด + คำตอบ
- ~200K token ≈ หนังสือ 500 หน้า — งาน Agent จริงหมดได้ในไม่กี่ชั่วโมง
- ใกล้เต็ม → ระบบ ย่อความเก่า (compaction) รายละเอียดช่วงแรกอาจหาย
อาการ "Agent เริ่มลืมข้อตกลงตอนต้น" = ผลของการย่อความ ไม่ใช่โมเดลโง่ลง
สมองและเชื้อเพลิง
ทางแก้: ความจำถาวรด้วยไฟล์ .md
Context Window = โต๊ะ
ชั่วคราว — จบ session = หาย
ควบคุมได้แค่ว่าจะวางอะไรบนโต๊ะ
ไฟล์ .md / Memory = ตู้
ถาวร — เขียนลงดิสก์ เปิด session ใหม่ก็อ่านกลับมาได้ครบ สดใหม่
- 1 งานใหญ่ = 1 session ใหม่ — อย่าลาก session เดียวข้ามหลายเรื่อง
- จดก่อนยาว — งานหลายชั่วโมง สั่งให้สรุปแผน/ความคืบหน้าลง .md เป็นระยะ
- อย่าเทของไม่จำเป็น — paste เฉพาะส่วนที่เกี่ยว ไม่ใช่เอกสารทั้ง 100 หน้า
ลงเครื่อง
ไฟล์คู่มือที่ Agent อ่านเองทุกครั้ง (CLAUDE.md ↔ AGENTS.md)
| วางไว้ที่ไหน | Claude Code | Codex |
| ส่วนตัว — ใช้ทุกโปรเจกต์ | ~/.claude/CLAUDE.md | ~/.codex/AGENTS.md |
| ในโฟลเดอร์โปรเจกต์ | CLAUDE.md | AGENTS.md |
- คนละชื่อไฟล์ แต่แนวคิดเดียวกัน — ไฟล์ .md ธรรมดาที่ Agent อ่านเองก่อนเริ่มงาน ไม่ต้องสั่งซ้ำทุก session
- ตัวในโฟลเดอร์โปรเจกต์ ทับ ตัวส่วนตัว — กติกาเฉพาะงานชนะเสมอ
- เขียนสั้น กระชับ — ถูกโหลดทุก session กิน context ถาวร
- ใช้ทั้งสองค่าย: เขียนเนื้อหาจริงไว้ไฟล์เดียว อีกไฟล์ใส่บรรทัดเดียวว่า อ่าน AGENTS.md — ไม่ต้องดูแลสองชุด
ไฟล์คู่มือ = นิสัย · Skill = ทักษะอาชีพ (เจอกันในหมวดระบบนิเวศ)
# CLAUDE.md / AGENTS.md ตัวอย่าง
## โปรเจกต์นี้คืออะไร
รายงานยอดขายรายไตรมาส ทีมการตลาด
## กติกา
- ตอบภาษาไทยเสมอ
- เอกสารใช้ฟอนต์ Sarabun
- ห้ามแก้ไฟล์ใน /raw-data โดยไม่ถาม
## สไตล์งาน
- สรุปสั้น ตัวเลขต้องมีที่มา
ลงเครื่อง
Skill — สูตรงานสำเร็จรูป
- โฟลเดอร์ที่มี SKILL.md บรรจุ "วิธีทำงานชนิดหนึ่ง" — เขียนครั้งเดียว ใช้ซ้ำตลอด
- เรียกด้วย /ชื่อskill หรือ Agent หยิบเองเมื่องานเข้าเงื่อนไข
- ตัวอย่าง: skill ทำเอกสาร Word, ทำสไลด์, เจนภาพตาม CI แบรนด์ (บรีฟ CI ครั้งเดียวจบ)
CLAUDE.md = นิสัย · Skill = ทักษะอาชีพ
ลงเครื่อง · 🆚
ไฟล์ .md vs Skill — ต่างกันยังไง
.md = ความจำ/กติกา (บอกว่า "เป็นยังไง") · Skill = สูตรทำงาน (บอกว่า "ทำยังไง") — ใช้คู่กัน ไม่ใช่แทนกัน
| ไฟล์ .md (CLAUDE.md / โน้ต) | Skill (SKILL.md + โฟลเดอร์) |
| บทบาท | นิสัย กติกา ความจำของโปรเจกต์ | ทักษะอาชีพ — วิธีทำงานชนิดหนึ่งแบบครบสูตร |
| ถูกโหลดเมื่อไหร่ | CLAUDE.md โหลดทุก session อัตโนมัติ (กิน context ตลอด) | โหลดเฉพาะเมื่อถูกเรียก (/ชื่อskill หรืองานเข้าเงื่อนไข) |
| เนื้อหาข้างใน | ข้อความสั้น ๆ: โปรเจกต์คืออะไร กติกา สไตล์ ข้อห้าม | ขั้นตอนละเอียด + ไฟล์แนบได้ (เทมเพลต, ภาพตัวอย่าง, สคริปต์) |
| ขอบเขต | ผูกกับโฟลเดอร์/เครื่อง (user-level หรือ project-level) | ใช้ข้ามโปรเจกต์ได้ แชร์ต่อให้คนอื่นได้ |
| ตัวอย่าง | "ตอบภาษาไทยเสมอ ห้ามแก้ /raw-data" | "วิธีทำสไลด์ ZenityX ครบทุกขั้น + เทมเพลต" |
จำง่าย ๆ: อยากให้ Agent "จำ" → เขียน .md · อยากให้ Agent "ทำเป็น" → สร้าง Skill
คุมบังเหียน
ใช้ Agent ยังไงให้ปลอดภัย
ไม่ต้องรู้เรื่องเทคนิค — จำแค่ 3 ข้อนี้ ทำทุกครั้งก็พอ
ก๊อปไฟล์เก็บไว้อีกชุดก่อนเริ่ม
ให้ Agent ทำกับตัวก๊อป ส่วนตัวจริงเก็บไว้อีกที่ — ถ้ามันทำพัง ก็แค่ก๊อปมาใหม่
อ่านก่อนกดตกลงทุกครั้ง
ตอนมันขออนุญาต ดูก่อนว่ามันจะทำอะไรกับไฟล์ไหน โดยเฉพาะเวลาเห็นคำว่า ลบ หรือ เขียนทับ
เก็บรหัส (key) ให้ดีเหมือนบัตรเครดิต
ไม่ส่งให้ใคร ไม่แปะในแชท และตั้งเพดานเงินไว้ก่อนเสมอ — หายก็ยกเลิกแล้วขออันใหม่ได้
ระบบนิเวศ
Capabilities — ความจำข้าม Session
ความสามารถเสริมระดับแอป เปิด/ปิดได้ในตั้งค่า — แก้โรค "ความจำเสื่อมทุกครั้งที่เปิดใหม่"
Search and reference chats
ค้น "แชทเก่า" ของคุณได้ — เช่น "โปรเจกต์นี้เคยคุยเรื่องราคาไว้ว่ายังไง" → ดึงจาก session ก่อนมาอ้างอิง ไม่ต้องเล่าใหม่
Generate memory from history
สกัด "ข้อเท็จจริงถาวร" จากบทสนทนา (คุณเป็นใคร ชอบสไตล์ไหน งานอะไรค้าง) เก็บเป็น memory อัตโนมัติ — session ใหม่ก็จำคุณได้
สมองและเชื้อเพลิง · 🔑
API Key คืออะไร
รหัสประจำตัว + บัตรเครดิต ในสตริงเดียว — บอกผู้ให้บริการว่า "คำขอนี้มาจากใคร และเก็บเงินใคร"
# หน้าตาของ API key
sk-ant-api03-Xq7fK2mNp...ยาว ~100 ตัวอักษร
เปรียบ: กุญแจห้องพัก + บัตรรูดค่าใช้จ่ายในตัว — ทำหาย ไม่ใช่แค่เข้าห้องไม่ได้ แต่คนเก็บได้เอาไปรูด
สมองและเชื้อเพลิง · 🔑
"ต่อ API แบบไม่เขียนโค้ด" = วาง key ในที่ที่ Agent หยิบใช้เองได้ (env / config) — วางครั้งเดียว จบ
ระบบนิเวศ
Connectors (MCP) — เสียบปลั๊กโลกภายนอก
- มาตรฐานชื่อ MCP (Model Context Protocol) — "พอร์ต USB ของ AI"
- เชื่อมแล้ว Agent ได้ เครื่องมือชุดใหม่: Google Drive, Slack, Notion, ฐานข้อมูล, API เจนภาพ/วิดีโอ
- ไม่ต้องเขียนโค้ด — กด connect / login ครั้งเดียว ใช้ได้เหมือนเครื่องมือในตัว
- ระวัง: connector = ประตูสู่ข้อมูลจริง → เชื่อมเฉพาะที่เชื่อถือได้
ระบบนิเวศ · 🆚
กติกามือใหม่: มี MCP → ใช้ MCP ก่อนเสมอ / ไม่มี หรือต้องการเกินเมนู → ค่อยลง key ตรง · MCP บางตัวก็ใช้ key ข้างใน แต่กรอกครั้งเดียวแล้วมันจัดการต่อให้
สรุป
แผนที่ความจำ + Checklist ก่อนใช้จริง
โฟลเดอร์ = โต๊ะทำงาน
Model + Effort = สมอง + ความตั้งใจ
Token = ค่าแรง/สมาธิที่จำกัด
.md / Memory = สมุดบันทึกถาวร
API Key = พวงกุญแจ + บัตรเครดิต
Permission = ระดับอิสระที่ให้
Skill = สูตรที่ฝึกแล้ว
Connector/Plugin = ปลั๊กเสริม / แพ็กรวม
ตั้ง API key + spending limit
พร้อมแล้ว — ไปสร้าง Agent ตัวแรกกัน 🚀