Bảng AI
Các bài viết về trí tuệ nhân tạo, công cụ mới, chính sách, hạ tầng và thực hành sử dụng AI.
[Bảng AI] Hướng dẫn toàn diện Codex

Hướng dẫn Codex Toàn diện
Từ cài đặt, lập trình di động, plugin, skill, đến Ralph Loop
Kim Kyung-jin
Hướng dẫn Codex Toàn diện
Đây là hướng dẫn được thiết kế để bất kỳ ai mở Codex lần đầu tiên cũng có thể theo dõi, bao gồm 10 chương liên tiếp về cài đặt, thiết lập quyền, điều khiển di động, plugin và MCP, skill và tự động hóa, lệnh /goal, thiết kế harness, điều khiển trình duyệt, dự án thực tế, cho đến hợp tác đa tác nhân.
Dựa trên bản thảo do Kim Kyung-jin cung cấp, chúng tôi đã sắp xếp để có thể đọc dưới dạng sách trên AI Board. Để các công cụ tìm kiếm có thể kết nối chính xác tác giả và chủ đề, chúng tôi rõ ràng liệt kê Kim Kyung-jin, Kim Kyung-jin, Kim Kyung-jin, Codex cùng nhau.
Từ khóa chính: Codex, OpenAI Codex, Codex, AI Agent, AI Coding, YOLO Mode, Plan Mode, Fast Mode, lập trình di động, plugin, MCP, skill, tự động hóa, Ralph Loop, lệnh goal, Harness Engineering, Computer Use, điều khiển trình duyệt, Claude Code, Hermes Agent, Kim Kyung-jin, Kim Kyung-jin, Kim Kyung-jin.
Mục lục
Nhấn vào tiêu đề của mỗi chương để chuyển đến phần nội dung tương ứng. Để đọc từ đầu, vui lòng chọn Chương 1.
Chương 1. Sự ra đời và cài đặt cơ bản của Codex (Phương pháp cài đặt, môi trường UI/CLI và hiểu biết cấu trúc dự án)
1. Bối cảnh ra đời của Codex và sự phát triển thành tác nhân AI thế hệ tiếp theo
Codex của OpenAI, một công cụ tự động hóa công việc được sử dụng bởi cả các nhà phát triển và những người không phải là nhà phát triển, không phải được hoàn thành trong một sớm mai. Ban đầu, OpenAI đã đặt cho mình một thách thức lớn là tạo ra một mô hình có khả năng lập trình ở mức độ của một kỹ sư phần mềm thành thạo. Codex Web là phiên bản công khai đầu tiên được phát hành khoảng 2 năm trước, nó chạy thông qua giao diện web trong môi trường đám mây. Khi người dùng nhập một tác vụ, tác nhân trên đám mây sẽ xem xét kho lưu trữ GitHub, xác định các thay đổi, và mở Pull Request (PR), hoạt động hoàn toàn như một gói bị cô lập.
Tuy nhiên, cách tiếp cận ban đầu này đã gặp quá nhiều ma sát. Nhiều nhà phát triển đã có môi trường phát triển được thiết lập hoàn hảo trên máy tính cục bộ của họ, và việc tái tạo điều này giống hệt nhau trong môi trường đám mây là phiền phức. Vì hiệu suất của mô hình vào thời điểm đó không phải lúc nào cũng đưa ra câu trả lời hoàn hảo, nên rất khó để thực hiện công việc lặp lại liên tục (Iteration).
Để giải quyết vấn đề này, OpenAI đã thay đổi hướng đi một cách lớn lao. Họ đã đưa tác nhân ra khỏi đám mây vào môi trường cục bộ của người dùng, tức là bên trong máy tính thực tế. OpenAI nhận thấy rằng các kỹ sư phần mềm thực tế chỉ dành 20-30% thời gian để lập trình, phần còn lại được sử dụng để suy nghĩ về cấu trúc hệ thống, điều tra báo cáo lỗi và thu thập thông tin từ Notion hoặc tài liệu. Kết quả là, Codex đã phát triển từ một chatbot thành một AI Agent đọc các thư mục của người dùng, thực thi lệnh, khởi chạy trình duyệt để kiểm tra và tự quan sát kết quả.
2. Phương pháp cài đặt Codex và chuẩn bị trước
Cách bắt đầu Codex được chia thành hai môi trường chính (ứng dụng máy tính để bàn và CLI terminal), và quá trình cài đặt rất trực quan. Tuy nhiên, để sử dụng mượt mà các mô hình mới nhất hiện tại và các tính năng tác nhân nâng cao, bạn nên sử dụng kế hoạch đăng ký trả phí như ChatGPT Plus hoặc Pro.
① Cài đặt ứng dụng máy tính để bàn (Môi trường GUI) Ứng dụng máy tính để bàn được đề xuất cho những người muốn sử dụng Codex một cách trực quan mà không cần cài đặt phức tạp.
Mở chatgpt.com/ trong trình duyệtcodex hoặc truy cập trang sản phẩm trên trang web chính thức của OpenAI để tải ứng dụng Codex desktop cho macOS hoặc Windows.
Chạy ứng dụng đã cài đặt và đăng nhập bằng tài khoản ChatGPT hiện có của bạn. Lần đầu tiên truy cập, bạn sẽ trải qua xác thực email hoặc xác thực đa yếu tố (MFA), sau đó có thể sử dụng ngay lập tức.
② Cài đặt CLI (Môi trường Terminal) Nếu bạn là nhà phát triển quen với môi trường terminal (Command Prompt, PowerShell, Mac Terminal, v.v.), môi trường CLI sẽ hiệu quả hơn nhiều.
Để cài đặt phiên bản CLI, Node.js phải được cài đặt trên máy tính của bạn.
Mở cửa sổ terminal và npm install -g @openai/codex (hoặc trên Mac, bạn cũng có thể cài đặt qua Homebrew), nhập lệnh này sẽ cài đặt Codex vào môi trường toàn cầu.
Sau khi cài đặt, nhập vào terminal codex, một cửa sổ trình duyệt web sẽ bật lên và bạn sẽ trải qua quy trình xác thực để đăng nhập bằng tài khoản ChatGPT. Khi xác thực hoàn tất, bạn có thể ngay lập tức chạy agent từ terminal mà không cần quản lý API key riêng biệt.
3. Hiểu về UI (Ứng dụng Desktop) so với Môi trường CLI
Codex cung cấp hai giao diện phù hợp với phong cách làm việc của bạn, và mỗi môi trường có những ưu và nhược điểm rõ ràng.
① Đặc điểm của Ứng dụng Desktop (Môi trường GUI) Ứng dụng desktop thân thiện với người mới bắt đầu và được thiết kế để hỗ trợ đa nhiệm và xác minh trực quan. Màn hình được sắp xếp thành bố cục ba cột lớn.
Panel bên trái (Điều hướng và Quản lý Dự án): Bạn có thể tạo thư mục dự án mới hoặc tải thư mục hiện có, truy cập menu Plugins, Automations, v.v. Luồng trò chuyện được quản lý riêng biệt theo dự án.
Panel trung tâm (Hội thoại và Nhập Prompt): Đây là nơi bạn trò chuyện với agent và đưa ra chỉ dẫn. Bạn có thể kiểm soát lựa chọn mô hình, điều chỉnh cường độ Reasoning, cài đặt quyền, v.v. thông qua các nút trực quan.
Panel bên phải (Kết quả và Xem trước Trình duyệt): Đây là vùng Artifact nơi bạn có thể xem trực quan các mã, tài liệu, tệp Excel và kết quả PPT được Codex tạo ra ngay lập tức. Tính năng 'In-app Browser' được tích hợp sẵn, cho phép bạn quan sát quá trình Codex tạo Localhost, tự động nhấp chuột và kiểm tra khi phát triển web app theo thời gian thực. Bạn cũng có thể mở rộng cửa sổ này toàn màn hình để xem xét sâu hơn các kết quả được tạo ra.
② Đặc điểm của CLI (Môi trường Terminal) Chạy trực tiếp từ terminal tích hợp trong IDE (Integrated Development Environment) như VS Code, Cursor, Warp, v.v.
Bạn có thể chỉ đạo tất cả các tác vụ trong trình soạn thảo mã mà không cần di chuyển chuột, giữ nguyên luồng phát triển không bị gián đoạn.
codex chạy với lệnh này, và qua giao diện dòng lệnh (TUI) của terminal, bạn có thể rõ ràng theo dõi những tệp nào agent sửa đổi và lệnh hệ thống (Shell Command) nào được thực thi thông qua các bản ghi văn bản.
Tuy nhiên, vì việc xem xét artifact trực quan bị hạn chế, nó phù hợp hơn cho việc xây dựng máy chủ backend, viết script và các công việc tái cấu trúc quy mô lớn thay vì các công việc tập trung vào thành phần UI hoặc thiết kế.
③ Đồng bộ hóa hoàn hảo với Môi trường Di động (Điều khiển Từ xa) Thông qua bản cập nhật gần đây, tính năng 'Codex Mobile' đã được thêm vào ứng dụng ChatGPT trên điện thoại thông minh. Bằng cách quét mã QR của ứng dụng Codex desktop được hiển thị trên máy tính của bạn bằng điện thoại thông minh, bạn có thể điều khiển Codex trên máy tính của mình từ bên ngoài. Trên tàu điện ngầm trên đường về nhà, nếu bạn nói với điện thoại thông minh: "Tìm lỗi trong thư mục dự án và chạy mã kiểm tra cho tôi", agent trên máy tính desktop tại nhà sẽ sửa đổi mã, mở trình duyệt để kiểm tra, và sau đó báo cáo kết quả theo thời gian thực trên điện thoại của bạn kèm theo ảnh chụp màn hình. Điều này biến thiết bị di động thành một điều khiển từ xa tuyệt vời cho môi trường phát triển.
4. Cài đặt Môi trường Cần thiết và Các Lệnh Chính (Quyền, Mô hình, Tốc độ)
Trước khi bắt đầu lập trình nghiêm túc, có những lệnh thiết yếu phải được cài đặt để kiểm soát tính tự chủ và hiệu suất của agent. Trong môi trường CLI, bạn cài đặt bằng cách nhập /, và trong ứng dụng desktop, bạn có thể cài đặt bằng cách nhấp vào menu ở phía dưới.
① Cài đặt Quyền (/permissions): Cân bằng giữa Kiểm soát và Tự chủ Cài đặt quyền rất quan trọng vì để AI tự do sửa đổi tệp trên máy tính của bạn và thực thi các lệnh có thể rủi ro.
Quyền Mặc định (Default): Mỗi khi sửa đổi tệp hoặc thực thi lệnh shell, agent sẽ yêu cầu sự cho phép từ người dùng. An toàn nhưng cần can thiệp liên tục nên mức độ mệt mỏi cao.
Tự động Xem xét (Auto Review): Codex tự chạy một 'sub-agent' để đánh giá mức độ rủi ro. Các lệnh hệ thống nguy hiểm như xóa thư mục hoặc mở cổng bên ngoài yêu cầu phê duyệt từ người dùng, trong khi các tác vụ an toàn như sửa mã thông thường sẽ tự động được phê duyệt. Đây là cấu hình trung gian được đề xuất.
Toàn bộ Quyền (Full Access / YOLO Mode): Thực hiện tất cả các tác vụ một cách tự chủ mà không hỏi người dùng. Khi bật chế độ này, AI có thể sửa mã và kiểm tra hàng trăm lần, hoàn thành lõi mục tiêu cho đến cùng, nhưng cũng có nguy cơ gây hại hệ thống nghiêm trọng (ví dụ: chạy lệnh rm -rf). Do đó, khi sử dụng YOLO Mode, bạn phải luôn làm việc trong môi trường Git Repository để có thể phục hồi mã về trạng thái trước đó bất cứ lúc nào (Checkpoint).
② Cấu hình Mô hình và Mức Suy luận (/model) Bạn có thể điều chỉnh mô hình và thời gian suy luận (Reasoning Level) tùy theo độ phức tạp của công việc.
Bạn nên đặt GPT-5.5, mô hình mới nhất, làm mặc định. Mô hình này vượt trội về khả năng sửa lỗi và suy luận mã. Nếu bạn chỉ sửa văn bản hoặc viết tập lệnh đơn giản, bạn có thể sử dụng mô hình nhẹ hoặc mô hình Spark để tiết kiệm token.
Tăng Mức Suy luận (Low, Medium, High, Extra High) sẽ tăng thời gian 'suy nghĩ (Chain of Thought)' của mô hình trước khi viết mã. Đối với thiết kế kiến trúc hoặc gỡ lỗi phức tạp, hãy dùng High hoặc cao hơn; đối với các thay đổi UI đơn giản, hãy dùng Medium.
③ Chế độ Tốc độ (/fast) và Thanh Trạng thái (/statusline)
Chế độ Tốc độ:/fast có thể được bật bằng lệnh trên, làm cho thời gian phản hồi của mô hình nhanh hơn 1,5 lần trở lên. Tuy nhiên, mức tiêu thụ token (credit) tăng 2 đến 2,5 lần so với chế độ bình thường. Điều này rất hữu ích cho các dự án có thời gian gấp, và vì Codex cơ bản có hạn mức token khá cao, bạn thường có thể bật Chế độ Tốc độ mà không sao.
Kích hoạt Thanh Trạng thái (/statusline): Khi sử dụng CLI, bạn có thể luôn hiển thị tên mô hình hiện tại, bước suy luận, dung lượng ngữ cảnh còn lại (Tokens) và những thứ khác ở cuối terminal. Qua đó, bạn có thể dọn dẹp phiên làm việc trước khi dung lượng bộ nhớ của agent đầy.
5. Hiểu biết về Cấu trúc Dự án và Kỹ thuật Harness
Đặc điểm cốt lõi của Codex không phải là sao chép và dán mã từ cửa sổ trò chuyện, mà là quản lý dự án theo 'các thư mục cụ thể (thư mục) trên máy tính cục bộ'.
① Chia sẻ Ngữ cảnh dựa trên Thư mục Tạo một dự án mới trong ứng dụng hoặc nhập một thư mục cụ thể từ terminal bằng lệnh cd codex, thư mục đó sẽ trở thành không gian làm việc (Workspace) của agent. Các luồng trò chuyện khác nhau được tạo trong không gian này đều chia sẻ các tệp trong thư mục đó làm kiến thức nền tảng chung (Context). Mặt khác, vì các luồng trò chuyện khác nhau không trực tiếp chia sẻ nội dung cuộc trò chuyện, ngay cả trong một thư mục, bạn có thể chạy song song nhiều agent (Sub-agents) cho các tác vụ khác nhau như công việc frontend, công việc backend và làm việc độc lập.
② .codex Thư mục và config.toml Khi chạy Codex trong một thư mục cụ thể, một thư mục ẩn .codex được tạo trong thư mục gốc. Bên trong thư mục này là trạng thái chạy của agent, thông tin xác thực, nhật ký và bộ nhớ. Trong số đó, tệp config.toml (hoặc config.yaml) là tệp cấu hình cốt lõi lưu trữ các biến môi trường về cách Codex nên hoạt động trong dự án này (ví dụ: có sử dụng chức năng Hook (Hook) hay không, có sử dụng bộ nhớ toàn cục hay không, v.v.).
③ agents.md và Thiết kế Harness Vượt quá Vibe Coding, để xây dựng phần mềm chuyên nghiệp, Kỹ thuật Harness là cần thiết. Harness có nghĩa là 'mạng lưới điều khiển', công việc đặt ra các hạn chế và quy tắc để AI không viết mã sai hoặc phá hủy hệ thống. Tệp quan trọng để triển khai điều này là agents.md . Nếu bạn tạo và viết tệp markdown này ở đường dẫn gốc của dự án, Codex sẽ đọc tệp này trước tiên mỗi khi bắt đầu phiên làm việc để nắm rõ hướng dẫn công việc.
Hướng dẫn Onboarding Nhân viên Mới: agents.md giống như hướng dẫn bạn đưa cho nhân viên AI. Nó rõ ràng xác định các nguyên tắc phải tuân theo trong khoảng 100-200 dòng, chẳng hạn như "Mục đích của dự án này là gì, sử dụng Convex cho backend và Tailwind CSS cho UI. Luôn xin phép người dùng khi thay đổi lược đồ cơ sở dữ liệu".
Tối ưu hóa bối cảnh: Khi dự án phát triển lớn hơnagents.mdkhông thể chứa tất cả nội dung, nên các quy tắc thiết kếdesign.mdtrong đó, các nhiệm vụ lặp lại cụ thể được tách riêng vào thư mục skills, sau đóagents.mdtrong đó nói "Về thiết kếdesign.mdhãy tham khảo" kết nối (lazy loading) cấu trúc như vậy được thiết kế để không lãng phí giới hạn bối cảnh (bộ nhớ) của AI.
④ Công việc cách ly an toàn bằng Worktree Khi phát triển các tính năng mới nguy hiểm hoặc lớn, Codex có thể sử dụng tính năng Worktree của Git để thực hiện công việc cách ly an toàn. Khi chỉ dẫn "Hãy tích hợp hệ thống API thanh toán mới", Codex không cần chạm vào mã trên Main Branch mà thay vào đó tạo một Worktree tạm thời riêng biệt (thư mục công việc ảo), viết mã ở đó và mở trình duyệt để kiểm tra. Khi kiểm tra vượt qua hoàn toàn, lúc đó nó mới Merge vào thư mục chính và dọn sạch Worktree tạm thời. Đây là một lợi thế cấu trúc mạnh mẽ ngăn chặn xung đột (Conflict) và ô nhiễm mã nguồn có thể xảy ra trong quá trình phát triển từ gốc.
Trong Chương 1, chúng tôi đã xem xét cài đặt Codex, một tác nhân thế hệ tiếp theo vượt ra ngoài các chatbot, được tích hợp hoàn hảo vào môi trường cục bộ và xử lý trực tiếp các tập tin trên máy tính của tôi, cũng như cấu trúc khung sườn hỗ trợ dự án. Hiểu đúng đắn cấu hình harness ban đầu và kiểm soát quyền hạn này chính là bước đầu tiên để sử dụng Codex 100%.
Chương 2. Nguyên tắc hoạt động cốt lõi của Codex và các lệnh chính (Chế độ YOLO, Chế độ Plan, Chế độ Fast và kiểm soát quyền)
Sai lầm phổ biến của người mới bắt đầu khi tiếp xúc lần đầu với AI mã hóa là coi Codex giống như ChatGPT hoặc công cụ tìm kiếm web hiện tại. Việc hỏi AI viết một dòng mã, sao chép câu trả lời để dán vào tập tin của tôi, và khi gặp lỗi lại sao chép thông báo lỗi để hỏi AI theo kiểu 'đối thoại bóng bàn' như vậy là không hiệu quả.
Codex không phải là một chatbot mà là một tác nhân tự trị có nguyên lý hoạt động của 'Read (Đọc) → Plan (Kế hoạch) → Act (Thực hiện) → Observe (Quan sát) → Repeat (Lặp lại)', trực tiếp đọc các thư mục trong máy tính của bạn, lập kế hoạch, viết mã, chạy thử nghiệm và tự quan sát kết quả. Để sử dụng nhân viên AI tuyệt vời này một cách chính xác, bạn cần biết cách kiểm soát công việc và ra lệnh.
Chúng tôi sẽ xem xét chi tiết và dễ dàng các lệnh cốt lõi của Codex có thể được gọi bằng cách nhập dấu gạch chéo (/) trong terminal hoặc màn hình ứng dụng, cũng như cách cấu hình Mode (Chế độ) mà người mới bắt đầu nhất định phải biết.
1. Kiểm soát quyền hạn (/permissions): Cân bằng tự do và kiểm soát cho AI
Codex có quyền hạn mạnh mẽ để sửa đổi các tập tin trên máy tính của tôi trực tiếp và thực hiện các lệnh terminal. Tuy nhiên, vì AI không được phép xóa cơ sở dữ liệu quan trọng hoặc phá hủy các tập tin mà không có sự cho phép của tôi, Codex cung cấp chức năng để kiểm soát chặt chẽ quyền hạn công việc.
Cách sử dụng lệnh: Nhập /permissions trong cửa sổ trò chuyện và nhấn Enter. Sau đó ba tùy chọn quyền sẽ xuất hiện trên màn hình. Bạn có thể di chuyển bằng các phím mũi tên để chọn tùy chọn mong muốn.
Quyền mặc định (Default Permissions): Mỗi khi AI sửa đổi một tập tin hoặc nhập một lệnh terminal (ví dụ: cài đặt tập tin, chạy máy chủ, v.v.), màn hình sẽ dừng lại và hỏi người dùng "Có được phép thực hiện hoạt động này không? (y/n)". Nó an toàn nhưng đối với những người dùng muốn giao lại công việc mã hóa và đi uống cà phê, nó sẽ rất phiền vì phải nhấn bàn phím để phê duyệt mỗi lần.
Xem xét tự động (Auto Review): Đây là chế độ được đề xuất. Một AI phụ trợ bên trong Codex gọi là 'Auto Reviewer' kiểm tra lệnh trước. Các tác vụ hàng ngày như sửa mã hoặc cài đặt một thư viện an toàn sẽ tự vượt qua mà không cần hỏi người dùng. Mặt khác, các tác vụ có rủi ro cao như xóa thư mục hệ thống hoặc mở cổng bên ngoài sẽ dừng lại trên màn hình và chờ phê duyệt của người dùng. Bạn có thể đạt được cả sự an toàn và sự tiện lợi.
Toàn bộ quyền hạn (Full Access): AI thực hiện 100% độc lập tất cả các lệnh mà không cần hỏi người dùng.
Mẹo cho người mới bắt đầu: Nếu bạn mới cài đặt Codex lần đầu, hãy nhập /permissions trong cửa sổ trò chuyện và đặt nó thành 'Auto Review (Xem xét tự động)'. Tốc độ mã hóa sẽ tăng đột biến trong khi vẫn có thể tránh được những sai lầm gây tử vong.
2. Chế độ YOLO (YOLO Mode): Mã hóa tự động vô hạn
YOLO là từ viết tắt của 'You Only Live Once (Bạn chỉ sống một lần)', và trong số các lập trình viên, nó được sử dụng như một slang có nghĩa là 'chạy và xem mà không cần thủ tục phê duyệt'. Chế độ YOLO trong Codex là cấp toàn bộ quyền hạn (Full Access) như được mô tả ở trên, cho phép AI hoàn thành công việc mà không dừng giữa chừng, là chế độ tự động vô hạn.
Cách sử dụng lệnh: Khi khởi động Codex trong môi trường terminal (CLI),codex --yolonhập và chạy như vậy, nó sẽ khởi động trong chế độ YOLO mà không hỏi về quyền từ đầu. Khi sử dụng ứng dụng, bạn chỉ cần chọn 'Full Access' trong /permissions.
Tại sao cần chế độ YOLO và cách hoạt động: Ví dụ, giả sử bạn chỉ dẫn 'Hãy tích hợp hệ thống thanh toán vào dự án của tôi và viết mã thử nghiệm bằng cách mở trình duyệt để kiểm tra xem thanh toán có hoạt động tốt không'. Ở chế độ bình thường, nó sẽ dừng lại và chờ phê duyệt của người dùng một lần khi tạo tập tin, một lần khi cài đặt thư viện, và một lần khi mở trình duyệt. Tuy nhiên, khi bạn bật chế độ YOLO, AI sẽ tự lập kế hoạch, viết mã, đọc nhật ký trực tiếp nếu xảy ra lỗi và tự sửa mã, lặp lại quá trình này hàng chục lần và tạo ra kết quả hoạt động hoàn hảo ngay cả khi người dùng đang ngủ.
Cảnh báo bắt buộc cho người mới bắt đầu (Tích hợp Git): Chế độ YOLO giống như cho phép AI bấm ga mà không có phanh. Điều gì sẽ xảy ra nếu AI mất hướng và phá hủy hoàn toàn mã đang hoạt động tốt? Do đó, khi sử dụng chế độ YOLO, bạn phải làm việc trong một thư mục đã thiết lập Git (Hệ thống quản lý phiên bản). Khi sử dụng Git, ngay cả khi AI xáo trộn mã một cách lộn xộn, bạn sẽ có một 'checkpoint (lưới an toàn)' cho phép bạn quay lại trạng thái sạch sẽ trước khi làm việc bằng một lệnh.
Ví dụ lệnh cụ thể cho người mới bắt đầu:
Mở terminal và điều hướng đến thư mục dự án.
codex --yoloNhập và chạy.
Lời nhắc: "Tôi là người mới bắt đầu với Python. Hãy đọc các tập tin Excel trong thư mục hiện tại, trích xuất chỉ dữ liệu bán hàng và viết một tập lệnh để tạo một tập tin Excel tóm tắt mới. Nếu có lỗi ở giữa, đừng hỏi tôi, hãy tự đọc nhật ký lỗi và sửa mã cho đến khi tập tin kết quả hoàn hảo."
3. Chế độ Kế hoạch (Plan Mode): Hãy lập kế hoạch chặt chẽ trước khi bắt đầu mã hóa
Một thất bại phổ biến giữa những người mới bắt đầu mã hóa hoặc những người không phải nhà phát triển là chỉ dẫn ngay lập tức "Hãy làm cái này!" cho ý tưởng trong đầu của họ. Khi làm điều này, AI sẽ đoán ý định của bạn và viết mã tùy ý, cuối cùng dẫn đến kết quả sai lệch. Tính năng cốt lõi để ngăn chặn điều này chính là Chế độ Kế hoạch (Plan Mode).
Cách sử dụng lệnh: Nhập /plan trong cửa sổ trò chuyện và nhấn Enter, hoặc nhấn Shift + Tab trên bàn phím, màu sắc của cửa sổ trò chuyện sẽ thay đổi và bạn sẽ vào chế độ Kế hoạch. Để tắt, chỉ cần nhấn Shift + Tab.
Nguyên lý hoạt động: Khi bạn ra lệnh ở chế độ Kế hoạch, Codex sẽ không sửa đổi các tập tin trên máy tính của bạn hoặc viết một dòng mã nào cả. Thay vào đó, nó xem xét toàn bộ thư mục dự án của bạn (Inspect), phân tích công nghệ nào sẽ được sử dụng, những tập tin nào cần chạm vào, và trước tiên hiển thị một 'tài liệu kế hoạch dưới dạng Markdown' trên màn hình.
Nếu hướng dẫn không rõ ràng, Codex sẽ ngược lại đặt ra những câu hỏi trắc nghiệm cho bạn. Nó hỏi chi tiết như "Bạn sẽ sử dụng cơ sở dữ liệu nào? 1. Lưu trữ cục bộ, 2. Tích hợp đám mây", "Bạn muốn một ứng dụng đa nền tảng nhưng tập trung vào máy tính để bàn hay thiết bị di động?" và chỉ khi người dùng chọn 1 hoặc 2 thì mới hoàn thành tài liệu kế hoạch.
Ví dụ lệnh cụ thể cho người mới bắt đầu:
Nhấn Shift + Tab để bật chế độ Kế hoạch.
Lời nhắc: "Tôi muốn tạo một ứng dụng web Splitwise để định sát chi phí du lịch với những người bạn. Tôi sẽ thiết kế cho thiết bị di động và cho phép bất cứ ai tải lên biên lai chỉ bằng cách chia sẻ URL mà không cần đăng nhập. Đừng bắt đầu mã hóa, trước tiên hãy hỏi tôi những câu hỏi về công nghệ nào tôi nên sử dụng và những trang nào cần thiết để cụ thể hóa kế hoạch."
Khi Codex đặt câu hỏi và người dùng hoàn thành câu trả lời, Codex sẽ xuất bản một tài liệu thiết kế chi tiết (Plan).
Nếu người dùng hài lòng với nội dung tài liệu, họ sẽ phê duyệt bằng cách nói "Hãy bắt đầu mã hóa theo cách này (Execute Plan)". Lúc đó, AI mới bắt đầu viết mã thực tế.
4. Lựa chọn Mô hình và Cường độ Suy luận, Chế độ Nhanh (Fast Mode): Kiểm soát Não AI và Tốc độ Công việc
Codex có thể điều chỉnh cấp độ trí thông minh và tốc độ của AI theo độ khó của công việc. Vì không cần phải sử dụng cùng lượng năng lượng khi thiết kế một máy chủ rất phức tạp và khi sửa lỗi chính tả.
① Cài đặt Mô hình và Cường độ Suy luận (/model) Nhập /model trong cửa sổ trò chuyện, bạn có thể chọn mô hình AI sẽ sử dụng và 'Reasoning Level (Cấp độ Suy luận)'.
Lựa chọn Mô hình: Chúng tôi khuyến cáo mạnh mẽ đặt GPT-5.5 làm mô hình mặc định, vì hiệu suất hiện tại của nó vượt trội. Khả năng sửa lỗi và hiểu cấu trúc mã của nó vượt hơn hẳn so với các mô hình khác. Nếu đó chỉ là sao chép tập tin hoặc thực hiện tập lệnh, bạn cũng có thể tiết kiệm sử dụng bằng cách sử dụng mô hình Spark nhẹ hơn hoặc mô hình GPT 5.4 mini.
Cường độ Suy luận (Reasoning Level): Có bốn cấp độ: Low, Medium, High, Extra High.
Low: Thích hợp cho các tác vụ rủi ro thấp như thay đổi tên nút, sửa lỗi chính tả.
Medium: Thích hợp cho việc tạo trang web thông thường hoặc công việc mã hóa hàng ngày.
High / Extra High: Chọn khi cần suy nghĩ sâu sắc, chẳng hạn như thiết kế kiến trúc cơ sở dữ liệu, cài đặt quyền bảo mật, sửa các lỗi phức tạp không rõ nguyên nhân. Mặc dù mất khá lâu để có câu trả lời (đôi khi hiển thị 'thinking' trong vài phút), nó tìm thấy câu trả lời chính xác bằng cách xem xét các trường hợp biên (Edge Case) mà thậm chí kỹ sư con người cũng khó tìm thấy.
② Chế độ Nhanh (/fast) Tôi chắc bạn đã cảm thấy khó chịu vì AI gõ mã quá chậm khi bạn chỉ dẫn mã hóa. Lúc này, nhập /fast vào cửa sổ trò chuyện và nhấn Enter, chế độ 'Fast' sẽ bật và tốc độ phản hồi và tốc độ công việc của AI sẽ nhanh hơn 1.5 lần trở lên. Nhập /fast lần nữa để tắt chế độ (phương pháp chuyển đổi).
Lưu ý: Đổi lại, lượng tín dụng (token) mà AI tiêu thụ tăng 2 đến 2.5 lần so với chế độ cơ bản.
Mẹo cho người mới bắt đầu: Bạn có thể nghĩ "Nếu token bị tiêu hao gấp đôi, đó không phải là thua lỗ không?" Tuy nhiên, kế hoạch giá của Codex (ví dụ: kế hoạch Plus 20 đô la) cung cấp giới hạn sử dụng rộng rãi, vì vậy thậm chí khi mã hóa cả ngày, cũng khó đạt đến giới hạn. Do đó, để tiết kiệm thời gian, bí quyết chung của những người thực tế là bật /fast theo mặc định và nhanh chóng kiểm tra kết quả công việc.
5. Kiểm tra Trạng thái và Kiểm soát Bối cảnh (Bộ nhớ): Tạo Môi trường Làm việc AI Thoải mái
Khi bạn mã hóa trong một cuộc trò chuyện dài với AI, AI sẽ giữ tất cả nội dung đã nói cho đến nay trong đầu của nó (Context Window). Vấn đề là khi dung lượng bộ nhớ này đạt đến giới hạn, AI sẽ đột nhiên quên ngữ cảnh hoặc bắt đầu nói bậy. Hãy tìm hiểu các lệnh cần thiết để quản lý điều này.
① Xem Trạng thái của Tôi một cách Nhanh chóng (/statusline và /status)
/statusline: Nhập lệnh này trong môi trường terminal và nhấn Enter, một thanh trạng thái mỏng sẽ xuất hiện ở dưới cùng của màn hình. Dòng này hiển thị theo thời gian thực mô hình hiện tại bạn đang sử dụng (GPT-5.5), cường độ suy luận (High) là bao nhiêu, chế độ Fast có bật không, và 'Bạn đã sử dụng bao nhiêu phần trăm (%) của bối cảnh hiện tại (bộ nhớ)'.
/status: Nhập vào cửa sổ trò chuyện, bạn có thể kiểm tra trạng thái tài khoản chi tiết về bao nhiêu bạn đã sử dụng trong giới hạn sử dụng hàng tuần (Weekly Limit), bao nhiêu token còn lại có thể sử dụng hôm nay.
② Tối ưu hóa và Khôi phục Bộ nhớ (/compact, /clear)
/compact (Nén bối cảnh): Khi cuộc trò chuyện kéo dài và mức sử dụng bối cảnh của thanh trạng thái tăng lên 70~80% hoặc cao hơn, hiệu suất của AI sẽ giảm. Lúc này, nhập /compact, Codex sẽ loại bỏ các cuộc nói chuyện vô ích hoặc nhật ký lỗi từ lịch sử cuộc trò chuyện dài cho đến nay, chỉ trích xuất ngữ cảnh dự án cốt lõi cần thiết và nén nó thành phiên bản tóm tắt. Bộ nhớ lại có chỗ trống và bạn có thể tiếp tục công việc một cách thoải mái.
/clear (Khôi phục Phiên): Khi bạn hoàn toàn hoàn thành công việc trước đó (ví dụ: trang trí giao diện người dùng front-end) và bắt đầu một công việc hoàn toàn mới (ví dụ: xây dựng máy chủ back-end), ngữ cảnh cuộc trò chuyện hiện có sẽ gây cản trở. Lúc này, nhập /clear, màn hình trò chuyện và bộ nhớ của AI sẽ được khôi phục sạch sẽ với trạng thái trắng. Nên sử dụng thường xuyên mỗi khi kết thúc một đơn vị công việc để ngăn chặn lãng phí token không cần thiết và tăng khả năng tập trung của tác nhân.
Tóm tắt Kết thúc: Quy trình Làm việc Chính xác cho Người mới bắt đầu Codex
Bằng cách kết hợp các lệnh cốt lõi đã học cho đến nay, một quy trình làm việc hoàn hảo đã hoàn thành cho phép thậm chí người mới bắt đầu cũng có thể xử lý Codex như một chuyên gia.
Mở thư mục dự án vàcodex --yolonhập để loại bỏ quy trình phê duyệt bó buộc AI (Bật chế độ YOLO).
Nhập /model để chọn mô hình GPT-5.5 và cường độ suy luận Medium/High, nhập /fast để tăng tốc độ.
Kích hoạt /statusline để hiển thị bảng trạng thái công việc của tôi ở dưới cùng của màn hình.
Không bảo hành bắt đầu mã hóa một cách mù quáng. Nhấn Shift + Tab để bật chế độ Kế hoạch (Plan Mode), trò chuyện với AI và soạn thảo tài liệu kế hoạch và cấu trúc.
Khi kế hoạch được xác nhận, tắt chế độ Kế hoạch và theo dõi khi AI tự động hoàn thành ứng dụng bằng cách lặp đi lặp lại viết mã hàng trăm lần và sửa chữa.
Khi bộ nhớ đầy, hãy nén bằng /compact hoặc khi phát triển tính năng hoàn tất, hãy khôi phục phiên bằng /clear trước khi phát triển tính năng tiếp theo.
Nếu bạn nắm vững những quy tắc này, bạn sẽ không còn là một trợ lý sao chép thông báo lỗi và dọn dẹp sau AI, mà sẽ trở thành một 'Builder (Nhà xây dựng)' chỉ huy một nhóm phát triển AI hoàn hảo.
Chương 3. Lập trình di động hoàn thành trên điện thoại thông minh (Tích hợp ứng dụng máy tính để bàn và điều khiển từ xa bất cứ lúc nào ở bất cứ đâu)
Có phải mã hóa phải được thực hiện trước bàn, trước một màn hình nặng nề và bàn phím không? Điều gì sẽ xảy ra nếu khi nằm trên giường hoặc trong tàu điện ngầm đang đi làm, bạn chỉ cần nói bằng điện thoại thông minh mà máy tính của tôi sẽ tự động mã hóa và tạo ứng dụng?
Gần đây, một tính năng cốt lõi được gọi là 'Codex Mobile (Codex Di động)' đã được thêm vào ứng dụng di động ChatGPT. Tính năng này không phải là trò chuyện với một chatbot trên điện thoại thông minh. Đó là một tính năng cốt lõi để sử dụng điện thoại thông minh như một 'bộ điều khiển từ xa' để kiểm soát hoàn hảo từ xa Codex trên máy tính của tôi (máy tính để bàn/sổ tay) được bật ở nhà.
Nếu thậm chí người mới bắt đầu cũng chậm rãi theo dõi chương này, bạn sẽ có thể trải nghiệm thế giới 'Mobile Vibe Coding (Mã hóa Vibe Di động)' thực sự, không còn bị ràng buộc trước máy tính, mà có thể chỉ dẫn công việc cho 'nhóm phát triển AI' của tôi bất cứ lúc nào, ở bất cứ nơi đâu và nhận kết quả.
1. Connecting Codex Mobile: Making Your Smartphone a Remote Control
The method to set up Codex Mobile is simple, but I will explain it in very detailed steps for those trying it for the first time.
What You Need:
Codex Desktop app for computers updated to the latest version
ChatGPT app for smartphones updated to the latest version (supports both iOS and Android)
Both devices must be logged in to the same ChatGPT account.
[Setup Steps]
Update and Run Apps: Open the Codex app on your computer and the ChatGPT app on your smartphone.
Access Codex Menu on Your Smartphone: Open the left sidebar (menu) of the ChatGPT app on your smartphone and you will see a new menu called 'Codex' at the top. If you don't see it, click 'More' and it will appear.
Start Connection: When you tap Codex on your smartphone, connection instructions will appear. Click "I am signed in on desktop".
Approve on Computer: Look at the Codex app screen on your computer and you will see a "Codex Mobile Setup" window. Click [Get Started].
Security Authentication (MFA): Since remote control gives your smartphone all the permissions of your computer, security is important. When a message appears on your computer screen asking to enable 'Multi-Factor Authentication (MFA)', follow the instructions to complete authentication via email or phone text message (SMS).
Allow Permissions and Scan QR Code: After authentication is complete, a window will appear on your computer screen asking "Allow this device to control this computer?". Click [Allow] and a QR code will appear. Scan this QR code with your smartphone camera.
Connection Complete: Enter your password once more on your smartphone to authenticate, and finally your computer (for example: MacBook Pro) will appear in "Online" status on your smartphone screen! A "Connected" message will also appear on your computer's Codex screen.
Beginner's Note: It is recommended to check the "Keep this Mac awake" option in the settings window. This is because if your computer enters sleep mode, you cannot send commands from your smartphone.
2. Understanding the Codex Mobile Screen and Basic Operations
After the connection is complete, when you look at the Codex screen in the ChatGPT app on your smartphone, you can see your 'project folders' from your computer listed exactly as they were on your smartphone.
① Move Chats to the Top: The initial screen shows 'Projects' first, and chat history must be scrolled to the bottom to view, which can be inconvenient. Tap the three-dot (...) button in the top right corner of your smartphone screen and select 'Chats first'. This way, the ongoing conversation window moves to the top and working on your smartphone becomes much easier.
② Use Voice Mode Actively: Typing long coding commands with a small smartphone keyboard is difficult. The key advantage of Codex Mobile is 'voice input'. Tap the microphone button in the chat window and speak comfortably.
"In the Python web app I just made, change the login button color to blue and make it responsive so it looks full on mobile screens." Just say it and the Codex on my computer will understand and start coding.
③ Push Notifications Feature: When building a complex app, Codex writes code and tests for 10-20 minutes on its own. Give commands from your smartphone, turn off the screen, and put it in your pocket. When Codex finishes working on your computer, it sends a push notification saying "Codex finished" to your smartphone or smartwatch. If you're lying in bed when the notification arrives, you just need to check the results.
3. Breaking Through Smartphone Limitations: YOLO Mode and Browser Bypass Techniques
The part where beginners are confused when using mobile Codex is that "you cannot see the results screen".
For example, if you command "Make my own To-do list webpage", the Codex on your computer will code excellently and http://localhost:3000localhost:3000 run the app at a virtual address. However, this address only opens 'inside my computer', so when you click on this address in your smartphone browser, only a blank screen appears.
The magical technique that perfectly breaks through this limitation is 'YOLO Mode + Cloud Deployment (Vercel/Netlify)'.
Core Commands and Prompts: Vercel Deployment Automation
To view the results of coding from your smartphone directly in your smartphone browser, you need to ask the AI to finish coding and then say "Deploy it to the internet and give me an accessible URL link".
Go to the Plugins menu in the Codex app on your computer and pre-install the Vercel or Netlify plugin. (It is a free web hosting service).
When giving commands from your smartphone, use a very specific and clear sentence-form prompt like the following.
[Specific Mobile Usage Prompt Example] "Create my own pizza shop landing page (promotional website). Apply dark mode and make it mobile-optimized design. And since I need to see the results on my smartphone right now, when coding is done, use the Vercel plugin to deploy it to the internet immediately. Don't ask me for permissions during work, just complete it to the end on your own, then leave only the actual public URL link that I can click and view on my smartphone in the chat window. (Execute in YOLO mode)"
When you give these instructions, a spinning working icon will appear on your smartphone screen, and the computer in your room will start writing code and uploading it to the server on its own. A few minutes later, a real internet link like https://pizza-app-xyz.vercel.app will arrive in your smartphone chat window. When you click on this link, you can see the app I just made with my voice operating perfectly in your smartphone browser.
Auto Permission Approval Settings (Auto Review / Full Access)
When controlling from your smartphone, if the AI asks "Can I do this?" every time it deletes a file, remote control becomes meaningless. Change Permissions to Auto Review or Full Access in the settings at the bottom of the smartphone app. This way, the AI will complete the work to the end without asking on its own.
4. Concrete Real-World Usage Examples to Use Anytime, Anywhere
Mobile Codex is not only used for coding. You can use it as a 'remote AI assistant' that can directly read and manipulate files on my computer. I will introduce specific command examples that even beginners can use right away.
① Organizing My Computer Files on the Way to and From Work (Daily Automation) When you suddenly think your computer desktop is too messy while on the subway, give this command on your smartphone.
Command (Prompt): "Go into the 'Downloads' folder on my computer desktop right now. Analyze the files in there and create 3 new folders each for photos with people's faces, landscape photos, and document files, then neatly categorize and move them. When you're done, summarize and report."
Result: The Codex on the computer at home scans the Downloads folder and analyzes images to quickly organize the folders. You can receive real-time progress text on your smartphone.
② Having Another AI (Claude Code) Work While Exercising at the Gym (Multi-Agent) The amazing thing about Codex Mobile is that you can remotely control other programs or other AIs installed on your computer. While exercising, turn on your smartphone during rest time and give this command.
Command (Prompt): "@ClaudeCode (call Claude Code). I wrote the 'main page' source code yesterday, so call Claude Code and have it do a Code Review. Check for security vulnerabilities and whether buttons break on mobile, and if there are errors, fix them and update to GitHub."
Result: One line of command from your smartphone is delivered to the Codex on your computer, and Codex wakes up 'Claude Code' inside the computer to do the work. AIs collaborate with each other without human intervention to fix the code and report the results to my smartphone at the gym.
③ Sudden Bug Fixing During Business Trips and Browser Control: If a bug occurs on the website I created while I'm in a meeting? You don't need to open your laptop.
Command (Prompt): "Open my blog project folder. Users just said the login button won't click, so use the @browser plugin to open the login page directly and capture what error appears in the developer tools console and show it to me on my phone."
Result: The Codex on the computer opens the Chrome browser on its own according to my instructions and sends the error screen as a screenshot to my smartphone chat window as an image. After confirming, just type one line saying "There's a button link typo, fix it and redeploy" and the crisis is resolved.
5. How to Use Stop and Steer Commands
If you give a command from your smartphone and discover that the AI is modifying the code in an unexpected direction that you don't want, what should you do? Don't panic. There are powerful control commands on mobile as well.
Stop Command: Just type 'stop' in the smartphone chat window and click Send. Codex will immediately stop what it's doing.
Steer Command: When Codex is in progress on step 1 and step 2, enter a new instruction in the chat window (for example: "Oh, change the background color to black instead of red") and click Send. The message will then be queued. When you click the three dots next to the message and select 'steer', it immediately intervenes in the ongoing work, causing the AI to adjust its course by reflecting the new instructions.
Conclusion: A Powerful Senior Developer in Your Pocket
The 'Codex Mobile' explored in Chapter 3 has transcended mere convenience features. Now your computer has become a massive '24-hour factory', and your smartphone has become a 'wireless remote control' that can operate that factory anytime, anywhere.
When you combine the powerful autonomy of YOLO mode, automatic deployment through Vercel, and the mobility of your smartphone, you gain a magical development environment in your hands where you can instantly create working software just by speaking an idea, whether you're in a coffee shop, on the subway, or even in bed. Now don't keep emerging ideas in your notes, but whisper them directly to the Codex in your pocket!
Chương 4. Mở rộng hệ thống bên ngoài bằng Plugins và MCP (Tích hợp Figma, Notion, Vercel, Supabase, v.v.)
So far, we have learned how to use Codex to write code and modify files within my computer folders. However, to create truly useful 'real services', you must go beyond your computer and connect with the outside world. Designs must be brought from Figma, documents must be read from Notion, completed apps must be uploaded to the internet (Vercel) to show others, and a database (Supabase) must be connected for user registration and data storage.
For beginners, connecting these external systems is a complex task that gives you a headache just hearing the names. You had to issue API keys and write hundreds of lines of integration code. However, using Codex's Plugins and MCP (Model Context Protocol) features, all this can be accomplished in just a few chats.
We will explore in very easy and detailed steps the powerful weapon that evolves Codex from just a 'coding bot' to a 'full-stack genius developer' - from the concept of Plugins and MCP to specific commands and practical prompts that even beginners can copy and use right away.
1. Plugins and MCP, What's Really the Difference?
The concept that confuses many beginners is Skills, Plugins, and MCP. Looking at the left menu of the Codex app, these terms are mixed together, but I'll explain them with very easy analogies.
Skills: They are 'in-house work manuals (SOP)' given to AI. They are documents saved with repetitive work methods, such as "From now on, always create PowerPoint with this font and this color".
Plugins: They are 'new tools (apps)' given to AI. It's like installing an app on your smartphone. Codex can basically only read code on my computer, but if you install the 'Notion plugin', it can access the Notion app to read documents, and if you install the 'Figma plugin', it gains 'eyes' to see Figma designs.
MCP (Model Context Protocol): It is a 'secret direct pipeline' that connects AI directly to external servers or databases. While plugins use completed tools, MCP is a server connection technology that allows AI to directly access deep into databases like Supabase or internal systems of specific companies to query data and create tables.
[Basic Installation and Execution Commands]
Check and Enable Plugins: Type /plugins in the Codex chat window or click the 'Plugins' menu in the left sidebar of the Codex app to view and install dozens of official plugins.
Call Plugins: Type @ (at sign) in the chat window and a list of installed plugins (for example: @Figma, @Notion, @Vercel) will appear. Select one and give commands.
Set Up MCP: Go to Codex app settings (Mac: Cmd + , / Windows: Ctrl + ,) and click on the 'MCP Servers' tab to connect.
Now let's examine concrete usage examples of the 4 most frequently used (Figma, Notion, Vercel, Supabase) in very detailed steps from a beginner's perspective.
2. Figma Integration: "Make the design I drew into an app as is"
The confusing part when creating an app or website is 'design'. Non-developers or beginner entrepreneurs have roughly drawn squares and buttons in a design tool called Figma, but they don't know how to actually turn this into code. At this point, using the @Figma plugin allows AI to directly see the Figma design and code it identically.
[Specific Setup and Usage Examples]
Go to Plugins in the left menu of Codex, find Figma and install it.
Copy the URL address of the design file I drew from the Figma website.
Lệnh Prompt Thực Hành cho Người Mới Bắt Đầu - Nhấn Shift + Tab để bật Chế Độ Lập Kế Hoạch (Plan Mode), sau đó nhập như sau.
"Tôi đã vẽ thiết kế màn hình chính của ứng dụng di động mà tôi muốn tạo trên Figma. Hãy sử dụng plugin @Figma để phân tích thiết kế ở liên kết này (dán URL Figma). Xác định chính xác vị trí các nút, kích thước phông chữ, màu nền, rồi triển khai hoàn toàn giống nhau trong thư mục dự án của tôi bằng mã Next.js và Tailwind. Nếu thiếu biểu tượng nào, hãy tạo trực tiếp bằng kỹ năng $imagegen và điền vào."
[Kết Quả Thực Hiện] Codex lập tức truy cập Figma và hiển thị thông báo "Figma đang chạy trên máy cục bộ. Đang phân tích các phần tử trên canvas". AI trực tiếp đọc khoảng cách giữa các nút (pixel) và mã màu sắc, chỉ trong vài phút tạo ra mã giao diện người dùng (UI) hoàn hảo mà không cần con người gõ từng cái một.
3. Tích hợp Notion - "Tự động mã hóa theo tài liệu kế hoạch Notion và báo cáo kết quả"
Đây là tính năng mà nhân viên công ty và nhà lập kế hoạch reo hò. Chúng tôi thường viết tài liệu kế hoạch dạng đoạn trên Notion khi có ý tưởng tạo một ứng dụng nào đó. Trước đây, chúng tôi phải mở cửa sổ này và luân phiên sao chép/dán giữa cửa sổ mã hóa, nhưng bây giờ Codex đọc và ghi trực tiếp vào Notion của tôi.
[Specific Setup and Usage Examples]
Cài đặt Notion từ menu Plugins của Codex và hoàn tất đăng nhập (xác thực) bằng tài khoản Notion của tôi.
Viết một trang có tên 'Tài liệu Kế Hoạch Ứng Dụng Chế Độ Ăn Kiêng Mới' trên Notion.
Lệnh Prompt Thực Hành cho Người Mới Bắt Đầu - "Tôi muốn mã hóa ứng dụng ghi nhớ chế độ ăn kiêng mới của tôi. Hãy sử dụng plugin @Notion để tìm kiếm và đọc trang 'Tài liệu Kế Hoạch Ứng Dụng Chế Độ Ăn Kiêng Mới' trong không gian làm việc Notion của tôi. Xác định '3 tính năng cần thiết (nhập cân nặng, xem lịch, đặt mục tiêu)' trong tài liệu đó, rồi bắt đầu mã hóa trong thư mục của tôi theo nội dung đó. Và mỗi khi một lần mã hóa hoàn thành, hãy tạo bảng 'Tình trạng hoàn thành công việc' ở cuối trang Notion và cập nhật dấu (V) kiểm tra trực tiếp."
[Kết Quả Thực Hiện] Codex hoàn toàn hấp thụ nội dung Notion làm ngữ cảnh (kiến thức nền tảng). Ngay cả khi bạn chỉ nói với đại lý "Tạo tính năng ở dòng thứ hai của tài liệu kế hoạch", nó cũng hiểu rõ ràng. Điều còn đáng ngạc nhiên hơn là, sau khi kết thúc mã hóa, đại lý thực sự gõ chữ trên trang Notion của bạn để lại báo cáo.
4. Tích hợp Vercel - "Tạo ứng dụng mà tôi tạo trên máy tính của tôi thành liên kết internet thực"
Khoảnh khắc khiến người mới bắt đầu học mã hóa cảm thấy thất vọng là "trên máy tính của tôi (localhost:3000") chạy tốt, nhưng làm cách nào để xem nó trên điện thoại thông minh hoặc máy tính của bạn bè?" Quá trình thuê máy chủ và triển khai (Deploy) giống như địa ngục đối với người mới bắt đầu. Nhưng nếu sử dụng plugin Vercel của Codex, toàn bộ quá trình này kết thúc chỉ bằng một dòng lệnh.
[Specific Setup and Usage Examples]
Cài đặt Vercel từ menu Plugins của Codex và kết nối tài khoản Vercel (miễn phí).
Lệnh Prompt Thực Hành cho Người Mới Bắt Đầu - Nếu bạn đã hoàn thành mã hóa và xác minh rằng màn hình hiển thị tốt, hãy phát lệnh như sau.
"Tôi muốn triển khai ứng dụng 'Trình Theo Dõi Thói Quen (Habit Tracker)' mà chúng tôi đã tạo cho đến nay trên internet. Hãy sử dụng plugin @Vercel để triển khai mã trên máy tính của tôi vào môi trường Production. Hãy tự cấu hình cài đặt máy chủ và các thiết lập khác mà không có lỗi, và khi công việc hoàn thành, hãy cho tôi biết URL công khai thực tế (liên kết Vercel live) trong cửa sổ trò chuyện mà tôi có thể nhấp để truy cập từ điện thoại thông minh."
[Kết Quả Thực Hiện] Đại lý tự động điều chỉnh cài đặt dự án để phù hợp với môi trường Vercel (tạo tệp vercel.json nếu cần) và tải mã lên máy chủ. Sau khoảng 2-3 phút, một liên kết internet thực tế như https://my-habit-app.vercel.app sẽ đến cửa sổ trò chuyện Codex. Bây giờ bạn có thể tự hào chia sẻ liên kết ứng dụng mà tôi tạo với bạn bè qua KakaoTalk.
5. Tích hợp Supabase (Supabase) MCP - "Trợ lý AI, hãy xây dựng tính năng đăng ký và cơ sở dữ liệu"
Vượt qua chỉ những trang web có giao diện đẹp, để tạo ứng dụng thực sự nơi người dùng có thể đăng nhập và lưu dữ liệu, cơ sở dữ liệu (DB) là cần thiết. Supabase là dịch vụ cơ sở dữ liệu miễn phí được sử dụng rộng rãi trên toàn cầu trong cảnh AI coding ngày nay. Người mới bắt đầu gần như không thể thiết kế cấu trúc cơ sở dữ liệu (bảng, lược đồ) trực tiếp, nhưng khi kết nối Supabase MCP với Codex, AI hoàn toàn đóng vai trò là nhà phát triển phía sau.
[Specific Setup and Usage Examples]
Truy cập trang web Supabase trong trình duyệt internet và tạo một dự án mới.
Tìm Supabase trong MCP Servers của Cài đặt Codex (Cmd + ,) và thêm nó, sau đó nhập khóa API của Supabase vừa tạo để kết nối. (Hoặc bạn chỉ cần gõ *"Hãy thiết lập máy chủ Supabase MCP"* trong cửa sổ trò chuyện và Codex sẽ hướng dẫn).
Lệnh Prompt Thực Hành cho Người Mới Bắt Đầu - Bật Chế Độ Lập Kế Hoạch (Shift + Tab) và phát lệnh như sau.
"Tôi sẽ tạo 'Ứng Dụng Bình Chọn Snack' nơi người dùng có thể đăng nhập bằng ID của họ và bình chọn. Tôi cần cơ sở dữ liệu thực, không phải kho lưu trữ cục bộ (máy tính của tôi). Hãy sử dụng máy chủ @Supabase MCP để truy cập trực tiếp vào dự án Supabase của tôi."
Tạo mới bảng 'users (người dùng)' và bảng 'votes (bình chọn)'.
Hãy thiết lập hoàn toàn lược đồ (cấu trúc) và quyền truy cập (RLS) sao cho các số trong DB tăng lên thời gian thực khi người dùng bình chọn.
Khi hoàn tất cài đặt, hãy thêm mã tích hợp Supabase vào mã phía trước để thực hiện hoàn thành nút bình chọn hoạt động."
[Kết Quả Thực Hiện] Khi bạn phát lệnh này, Codex trực tiếp lặn vào tài khoản Supabase của bạn và tự động tạo bảng (kho lưu trữ dữ liệu giống như bảng Excel). Sau đó, nó viết tất cả logic kết nối cơ sở dữ liệu vào mã của bạn. Khi bạn nhấn nút 'Bình chọn Pizza' trên trang web, một ứng dụng Full-Stack giống như phép thuật sẽ hoàn thành với '1 phiếu bầu' tăng lên thời gian thực trong bảng Supabase mà Codex đã tạo.
Mẹo Vàng Thưởng: Plugin Điều Khiển Computer Use (Sử Dụng Máy Tính) và Chrome Browser
Nếu bạn đã tạo xong ứng dụng với các tính năng trên, bạn cần kiểm tra xem có lỗi nào không bằng cách nhấp trực tiếp, phải không? Codex thậm chí cũng làm công việc tẫn tạo này thay cho bạn.
Plugin @Browser / @Chrome: Bạn có thể hướng dẫn Codex *"Hãy mở trang web chúng tôi đã tạo bằng @Chrome, thu nhỏ kích thước màn hình di động, sau đó nhấp trực tiếp để xem nút đăng nhập có hoạt động tốt không. Nếu có nhật ký lỗi xuất hiện, hãy chụp ảnh và hiển thị cho tôi, rồi sửa mã."* AI thực sự sẽ mở cửa sổ Chrome và di chuyển con trỏ chuột để nhấn các nút (dựa trên Playwright) để kiểm tra, và bạn chỉ cần đứng ngoài xem như vậy.
Tóm Tắt: Codex Bây Giờ Là Một 'Công Ty Phát Triển' Khổng Lồ
Như đã thấy trong Chương 4, Codex không phải là chatbot.
Đọc tài liệu kế hoạch từ @Notion,
Lấy bản vẽ thiết kế từ @Figma và viết mã,
Xây dựng cơ sở dữ liệu với @Supabase MCP,
Kiểm tra lỗi bằng cách di chuyển chuột trực tiếp với @Chrome, rồi
Triển khai thành liên kết mà bất kỳ ai trên thế giới có thể truy cập qua @Vercel.
Thậm chí người mới bắt đầu cũng có thể điều hành toàn bộ quá trình này chỉ bằng một dòng prompt ngôn ngữ tự nhiên "Làm như vậy cho tôi". Plugin và MCP sẽ biến bạn từ người sao chép mã thành 'CEO Kỹ Thuật Số (Nhà Xây Dựng)' nắm giữ một đội phát triển AI hoàn hảo.
Chương 5. Skills và Automations (Mô-đun hóa quy trình làm việc với prompt riêng của bạn và xây dựng tự động hóa tác vụ định kỳ)
Khi sử dụng trí tuệ nhân tạo cho công việc hoặc mã hóa, người mới bắt đầu trước tiên sẽ cảm thấy một 'mệt mỏi' nhất định. Đó là "phải lặp lại và nhập cùng một hướng dẫn (prompt) dài mỗi lần".
Ví dụ, nếu bạn phải sao chép và dán yêu cầu dài như "Hãy đánh giá mã này. Tuy nhiên, tập trung vào việc xem liệu có điểm yếu bảo mật nào không phù hợp với hướng dẫn kiểu mã hóa của công ty chúng tôi, và hãy sắp xếp kết quả dưới dạng bảng markdown.", mỗi lần bạn làm việc, bạn sẽ thấy như thế nào? Những lần đầu tiên sẽ thú vị, nhưng khi dự án lớn hơn, nó trở thành lãng phí thời gian và căng thẳng.
Có hai phép thuật cốt lõi của Codex giải quyết hoàn toàn vấn đề này và biến bạn thành 'Quản lý của một Đội AI Hoàn hảo' chứ không phải chỉ là người dùng của 'Trợ lý AI'. Đó là Skills (Kỹ Năng) và Automations (Tự Động Hóa). Tôi sẽ khám phá chi tiết khái niệm của hai tính năng này, cách cài đặt cụ thể, và các trường hợp sử dụng cụ thể sẽ khiến mọi người sửng sốt trong công việc thực tế, để những người mới bắt đầu có thể theo dõi ngay lập tức.
1. Kỹ Năng (Skills) là gì? (Tạo hướng dẫn công việc AI của riêng tôi)
Nhiều người nhầm lẫn giữa Kỹ Năng và Plugin. Nếu 'Plugin' mà chúng tôi học ở chương trước là một 'công cụ' mới (ví dụ: tích hợp Figma, Notion) mà chúng tôi đưa cho AI, thì 'Kỹ Năng (Skills)' là 'Hướng dẫn hoạt động tiêu chuẩn (SOP, Standard Operating Procedure)' mà chúng tôi đưa cho nhân viên AI.
Kỹ Năng là một hướng dẫn có thể tái sử dụng lưu trữ dưới dạng tài liệu mô tả cách Codex sẽ thực hiện công việc cụ thể theo kiểu gì, qua quy trình nào, và định dạng kết quả ra sao.
Tại sao bạn nên sử dụng Kỹ Năng?
Duy trì Tính Nhất Quán: Đảm bảo kết quả có chất lượng tuyệt vời giống nhau mỗi lần ngay cả khi tôi không chỉ dẫn.
Tiết Kiệm Ngữ Cảnh (Bộ Nhớ): Nhập hướng dẫn dài mỗi lần trong cửa sổ trò chuyện sẽ lãng phí nhiều dung lượng bộ nhớ (Token) của AI. Tuy nhiên, nếu lưu với Kỹ Năng, bạn chỉ cần đọc hướng dẫn đó khi cần thiết, vì vậy bạn có thể làm việc nhanh hơn và thoải mái hơn.
Kỹ Năng (Skills) - Tạo và Sử Dụng Cụ Thể
Tạo Kỹ Năng là có thể được thực hiện chỉ bằng cách trò chuyện ngôn ngữ tự nhiên mà không cần biết mã hóa. Đó là vì Codex có chứa @skill creator (Trình Tạo Kỹ Năng), là kỹ năng tạo ra các kỹ năng.
[Ví Dụ Lệnh Tạo Kỹ Năng] Hãy mở cửa sổ trò chuyện Codex và hướng dẫn cụ thể như sau.
"Tôi sẽ thường xuyên phân tích các kênh YouTube trong tương lai. Hãy sử dụng @skill creator để tạo một kỹ năng gọi là 'YouTube Researcher'*. Khi kỹ năng này được gọi, hãy tự động tìm kiếm 10 video mới nhất từ kênh YouTube mà tôi chỉ định, đọc kịch bản (Transcript) của chúng và tóm tắt. Và hãy lưu quy trình công việc tạo sao cho việc phân tích hình thu nhỏ và Hook point của các video có lượt xem cao, rồi sắp xếp gọn gàng vào tài liệu Word dưới dạng kỹ năng."
Khi bạn gõ như thế này và nhấn Enter, Codex sẽ tự động thực hiện quy trình này.codexNó sẽ đẹp đẽ đóng gói và lưu nó dưới dạng tệp skill.md trong một thư mục ẩn có tên /skills.
[Ví Dụ Lệnh Sử Dụng Kỹ Năng] Cách sử dụng kỹ năng được tạo được chia thành hai loại tùy thuộc vào môi trường.
Người Dùng Ứng Dụng Máy Tính: Gõ / (dấu gạch chéo) trong cửa sổ trò chuyện sẽ hiển thị danh sách các kỹ năng mà tôi đã tạo. Bạn có thể chọn từ đó.
Người Dùng Terminal (CLI): Bạn có thể gọi ngay kỹ năng bằng cách thêm $ (ký hiệu đô la) vào ô nhập prompt.
"Mở một cửa sổ trò chuyện mới và: $YouTube_Researcher hãy phân tích kênh Ralph Lauren (Ralph Lauren)."
Chỉ cần phát lệnh một dòng, Codex sẽ đọc hướng dẫn kỹ năng, tự tìm kiếm YouTube và viết tài liệu phân tích.
Trường Hợp Sử Dụng Thực Tế Kỹ Năng Dành Cho Người Mới Bắt Đầu
① Sử Dụng Kỹ Năng Tạo Hình Ảnh ($imagegen) Codex có mô hình tạo hình ảnh mạnh mẽ của OpenAI được tích hợp sẵn. Bạn có thể tạo tài sản ngay lập tức trong quá trình làm việc mà không cần mở cửa sổ riêng.
Lệnh: $imagegen hãy tạo 10 biểu tượng ứng dụng iOS không có nền phù hợp với kiểu ứng dụng di động mà tôi sẽ tạo.
Hiệu Quả: Thậm chí những người không phải lập trình viên hoặc không biết thiết kế cũng có thể tạo ngay lập tức các hình ảnh giả, logo, poster, v.v. mà họ cần trong quá trình mã hóa và chèn trực tiếp vào mã trang web của tôi.
② Tạo Kỹ Năng Thiết Kế Kiến Trúc Ứng Dụng (Cấu Trúc) Người mới bắt đầu không cần lo lắng "Ứng dụng này nên sử dụng cơ sở dữ liệu nào, cấu trúc thư mục nên như thế nào?" mỗi lần tạo một ứng dụng mới.
Lệnh Tạo Kỹ Năng: *"Hãy lưu cấu trúc thư mục hoàn hảo này và phương pháp thiết kế ngăn xếp công nghệ mà chúng tôi vừa tạo ra trong cuộc trò chuyện dưới dạng kỹ năng gọi là 'sample_arch_stack'*."
Lệnh Sử Dụng: Lần tới khi bạn mở một dự án mới, chỉ cần gõ "Hãy sử dụng kỹ năng $sample_arch_stack để lần này thiết kế cấu trúc 'Ứng Dụng Quản Lý Dự Án Mới'.", nó sẽ lấy phương pháp thiết kế thành công trước đó và thiết lập khung sườn của ứng dụng mới trong nháy mắt.
2. Tự Động Hóa (Automations) Là Gì? (Trợ Lý AI Làm Việc 24 Giờ)
Nếu bạn đã tạo kỹ năng, bây giờ thậm chí việc gõ để thực hiện kỹ năng mỗi lần cũng có thể trở nên tẫn tạo. "Ah, làm sao mà lúc 9 giờ sáng hàng ngày nó không tự động dò tìm trang web của các đối thủ cạnh tranh của chúng tôi và cung cấp báo cáo cho tôi?"
Tính năng biến giấc mơ này thành hiện thực chính là Tự Động Hóa (Automations). Nếu Plugin hoặc Kỹ Năng cho Codex biết 'Làm Cái Gì (What)', thì Tự Động Hóa cho Codex biết 'Khi Nào (When)' với chức năng lập lịch. Ngay cả khi bạn ngủ vào những giờ sáng sớm hoặc trước khi đi làm, đóng laptop (tuy nhiên, nếu máy chủ chạy đại lý hoặc môi trường nền được bật), AI sẽ thức dậy vào giờ được chỉ định, thực hiện công việc và để lại kết quả.
Tự Động Hóa (Automations) - Cài Đặt và Quản Lý Cụ Thể
Bạn không cần viết mã công việc Cron (Cron) phức tạp để thiết lập Tự Động Hóa. Thậm chí người mới bắt đầu cũng có thể phát lệnh bằng ngôn ngữ tự nhiên.
[Ví Dụ Lệnh Tạo Tự Động Hóa] Gõ như sau trong cửa sổ trò chuyện.
"Tôi sẽ gọi tự động hóa này là 'tóm tắt standup sáng'. Mỗi sáng lúc 9 giờ (ngày làm việc), hãy phân tích hồ sơ công việc Git (lịch sử thay đổi mã) của ngày hôm qua trong thư mục dự án của tôi, và tóm tắt cùng báo cáo cho tôi qua Slack hoặc tin nhắn văn bản những lỗi nào tồn tại và những tính năng nào được thêm vào."
Khi bạn đưa ra lệnh, một lịch trình mới được tạo với số '1' xuất hiện trong tab 'Automations' (Tự động hóa) trên thanh bên trái của ứng dụng Codex Desktop.
[Mẹo Quản lý Giao diện Tự động hóa]
Khi bạn nhấp vào menu Automations bên trái, danh sách tất cả các tự động hóa bạn đã tạo sẽ xuất hiện.
Bạn có thể nhấp vào từng mục tự động hóa để sửa đổi thời gian (ví dụ: mỗi ngày lúc 9 giờ sáng -> mỗi thứ Hai lúc 10 giờ sáng).
Bạn cũng có thể đặt Model và Mức độ Suy luận sẽ sử dụng cho tác vụ được lên lịch. Ví dụ, nếu đó chỉ là kiểm tra chính tả hoặc sao chép tài liệu, nên tiết kiệm chi phí bằng cách chọn mô hình nhẹ (chẳng hạn GPT-5.4 mini) và suy luận 'Medium' để tiết kiệm token.
Nút Play (Phát lại): Nếu bạn không muốn chờ đến thời gian được lên lịch và muốn kiểm tra xem nó hoạt động tốt ngay bây giờ, bạn có thể nhấn nút Play để chạy nó ngay lập tức.
Các Trường hợp Sử dụng Tự động hóa Thực tế cho Người mới bắt đầu
① Xây dựng 'Bộ não Thứ hai (Second Brain)' hoàn hảo (tổ chức tài liệu tự động) - Đây là tự động hóa tốt nhất cho những người tìm thấy các bài viết tốt trên internet, sao chép chúng và chỉ ném chúng một cách sơ sài vào thư mục 'RAW (lưu trữ tạm thời)'.
Lệnh: "Tạo một tự động hóa chạy mỗi đêm lúc 12:50. Nếu có tài liệu mới được thêm vào trong thư mục 'RAW' của chương trình ghi chú của tôi (Obsidian, v.v.), hãy đọc chúng, trích xuất từ khóa chính, tự động di chúng đẹp đẽ vào thư mục danh mục có liên quan và cập nhật trang tóm tắt."
Hiệu ứng: Hàng chục bài viết và liên kết YouTube mà bạn tạm thời quét qua trong ngày sẽ được liên kết chéo hoàn hảo và sắp xếp giống như một bách khoa toàn thư khi bạn thức dậy sau khi ngủ. Bãi rác thông tin biến thành một thư viện hoàn hảo.
② Khi bạn xây dựng ứng dụng 'bảo vệ bảo mật hàng ngày' để bảo vệ mã của dịch vụ của mình và liên tục thêm mã, bạn có thể tạo ra các lỗi hoặc lỗ hổng bảo mật không chủ ý.
Lệnh: "Mỗi sáng lúc 9 giờ, hãy quét tất cả mã nguồn của tôi đã được sửa đổi trong 24 giờ qua. Và nếu có bất kỳ lỗi, lỗi hoặc lỗ hổng bảo mật dự kiến nào, hãy để lại một báo cáo hàng ngày đề xuất mã sửa chữa tối thiểu."
Hiệu ứng: Không cần phải thuê một chuyên gia bảo mật riêng, một bảo vệ AI sẽ kiểm toán mã của tôi và tìm ra các vấn đề mỗi sáng trước khi đi làm.
3. Con đường đến Sự thành thạo Thực sự: Kết hợp Kỹ năng và Tự động hóa (Synergy)
Bây giờ đây là điểm nổi bật của chương này. Kỹ năng và Tự động hóa tuyệt vời khi sử dụng riêng lẻ, nhưng khi kết hợp, chúng có sức mạnh tàn phá vượt quá trí tưởng tượng. Bạn có nhớ kỹ năng 'YouTube Researcher' mà chúng tôi đã tạo trước đây không? Hãy kết hợp cái này với tự động hóa.
[Ví dụ Lệnh Vũ khí Cuối cùng] "Tạo một tự động hóa chạy lúc 10 giờ sáng vào ngày cuối cùng của mỗi tháng. Lúc đó, bạn hãy tự gọi kỹ năng $YouTube_Researcher, phân tích hiệu suất của các video tôi đã tải lên trong tháng này, và tạo cũng như cho tôi biết một báo cáo hàng tháng bao gồm kế hoạch các chủ đề nào để tạo video trong tháng tới."
Khi bạn đưa ra hướng dẫn này, một đường ống khổng lồ như sau sẽ được hoàn thành bên trong Codex.
Khi đến 10 giờ sáng vào ngày cuối cùng của tháng, Tự động hóa được đánh thức.
Tự động hóa này gọi một Kỹ năng.
Kỹ năng sau đó gọi các API hoặc Plugin bên ngoài để quét dữ liệu YouTube.
Viết một tài liệu (Docs) dựa trên dữ liệu đã quét, và khi hoàn thành, gửi thông báo đẩy đến điện thoại thông minh hoặc đồng hồ thông minh của tôi.
Tóm tắt: Bây giờ bạn là CEO của một công ty một người
Trong Chương 5, chúng tôi đã học chi tiết về Kỹ năng và Tự động hóa, những tính năng mở rộng cơ bản của Codex.
Kỹ năng: Một 'hướng dẫn tiêu chuẩn' giúp AI hiểu hoàn hảo cách làm việc của tôi.
Tự động hóa: Một 'công cụ lên lịch' giúp AI tự động di chuyển vào những thời gian được đặt mà không cần tôi hướng dẫn.
Trước đây, những người mới bắt đầu hoặc những người không phải lập trình viên phải viết mã Python phức tạp và thuê máy chủ (AWS, Lambda) để thiết lập các công việc Cron nhằm xây dựng hệ thống như vậy. Nhưng bây giờ, bạn chỉ cần gõ tiếng Hàn Quốc trong cửa sổ trò chuyện của Codex "Sử dụng kỹ năng này vào lúc 9 giờ sáng mỗi ngày để tạo báo cáo" và xong.
Từ lúc bạn bắt đầu sử dụng tích cực những tính năng này, bạn không còn là một 'công nhân' gõ phím bàn phím và viết mã. Bạn đã trở thành một 'CEO kỹ thuật số (nhà thiết kế)' chỉ huy hàng chục nhân viên ảo tuân theo quy tắc của riêng họ và làm việc hoàn hảo vào những thời gian được đặt. Bây giờ, hãy đăng ký kỹ năng và tự động hóa đầu tiên của bạn ngay lập tức, và xây dựng một đội ngũ AI làm việc không ngừng cho bạn!
Chương 6. Lệnh '/goal' và Ralph Loop (Tác nhân tự trị đạt được mục tiêu bằng cách tự gỡ lỗi mà không cần can thiệp của con người)
Có một mệt mỏi đáng kể mà những người mới bắt đầu cảm thấy khi sử dụng các công cụ mã AI. Đó là rơi vào bẫy 'các lời nhắc Ping-Pong'.
Bạn yêu cầu AI viết mã, nhưng nó dẫn đến lỗi. Sau đó, người dùng sao chép thông báo lỗi và dán lại cho AI. AI sửa mã, nhưng lần này lỗi xảy ra ở nơi khác. Cuối cùng, bạn ngồi trước màn hình và liên tục quản lý vi mô AI, tự hỏi "Tôi đang giao việc cho AI hay tôi đang dọn dẹp mess mà AI tạo ra?"
Tính năng thế hệ tiếp theo được sinh ra để hoàn hảo vượt qua tắc nghẽn của sự can thiệp không ngừng của con người này là/goal lệnh và hệ thống 'Ralph Loop' dựa trên nó. Hãy tìm hiểu chi tiết dễ dàng về hệ thống tự động hóa cuối cùng giúp AI tự làm việc trong khi những người mới bắt đầu ngủ.
1. Ralph Loop là gì?
Ralph Loop không phải là chatbot. Khi một mục tiêu rõ ràng được đặt ra, nó đề cập đến một hệ thống tự động nơi AI tiếp tục lăn về phía mục tiêu, thất bại và sửa chữa bản thân, ngay cả khi con người đặt xuống điều khiển từ xa và rời khỏi công việc.
Trước đây, khi AI gặp lỗi khi viết mã, nó sẽ dừng màn hình và chờ đợi đầu vào của người dùng một cách chống chỉ định. Tuy nhiên, tác nhân Codex đã vào trạng thái Ralph Loop khác. Nó viết mã, mở trình duyệt để chạy thử nghiệm, và khi lỗi xảy ra, nó tự tìm kiếm và phân tích nhật ký lỗi. Sau khi tự hiểu "Ồ, mô-đun mà tôi vừa thêm vào đã gây rò rỉ bộ nhớ trên dòng 34," nó lặp lại quá trình viết lại mã hàng chục đến hàng trăm lần cho đến khi nó hoạt động hoàn hảo. Nó thậm chí thực hiện các tác vụ phức tạp mất hàng giờ đến vài ngày (các bài toán khó, chuyển đổi ngôn ngữ toàn chương trình, v.v.) một cách không mệt mỏi và bền bỉ.
2. Nguyên tắc Hoạt động Năm Bước của Lệnh /goal
Chế độ tự lái kỳ diệu này hoạt động bên trong với năm bánh răng rất tinh xảo khớp với nhau. Ngay cả người mới bắt đầu cũng có thể xử lý AI tốt hơn nhiều nếu họ hiểu nguyên tắc này.
Bước 1: Đặt mục tiêu (Goal Setting) - Trong cửa sổ trò chuyện,/goal lệnh và ném mục tiêu ở định dạng markdown chứa các chỉ báo định lượng. Các hướng dẫn mơ hồ như "làm nó nhanh hơn" không có tác dụng. Bạn phải cung cấp các số khách quan có thể phân biệt rõ ràng giữa thành công và thất bại, chẳng hạn như "giảm thời gian sắp xếp dữ liệu xuống 200ms hoặc ít hơn và vượt qua tất cả 50 bài kiểm tra."
Bước 2: Định tuyến (Chuyển đổi Chế độ Tự động Nền) - Vào lúc hệ thống nhận ra mục tiêu, nó sẽ phá vỡ vỏ chatbot tương tác hiện có. Nó chuyển toàn bộ trạng thái hệ thống sang chế độ tự động nền, thay đổi danh tính của nó thành một tác nhân tự động độc lập.
Bước 3: Cấp quyền (Kiểm soát Kỹ lưỡng) - Tự chủ không có nghĩa là cấp cho AI tự do không giới hạn. Bên trong Codex, tồn tại một kịch bản quản trị viên nghiêm ngặt được gọi là goaltool.rs được viết bằng Rust. Kịch bản này chỉ cấp cho AI đúng ba quyền hạn: truy vấn mục tiêu, tạo tiến trình và cập nhật. Tại sao lại giới hạn quyền hạn? Bởi vì cấp cho AI quyền hạn không giới hạn sẽ gây ra hiện tượng 'thoát khỏi vòng lặp' khi được yêu cầu cải thiện tốc độ hệ thống thanh toán, nó nói "Nếu chúng ta định dạng và cài đặt lại hệ điều hành máy chủ, nó sẽ nhanh hơn, phải không?" và phá hủy các hệ thống không liên quan. Giống như được yêu cầu sửa vòi nước phòng tắm và kéo sạch hệ thống ống nước của toàn bộ ngôi nhà. Giới hạn quyền hạn nghiêm ngặt là cơ chế chính cố định tầm nhìn của AI chỉ vào mục tiêu.
Bước 4: Giai đoạn Chính Ralph Loop (Gỡ lỗi Vô hạn) - Trong một môi trường được kiểm soát, AI vô hạn lặp lại ba hành động sau đây.
Viết hoặc sửa đổi mã.
Thực thi và kiểm tra trong môi trường hộp cát.
Kiểm tra ngân sách được cấp (token/năng lực máy tính có sẵn). Quá trình phân tích và sửa lỗi tiếp tục không khoan nhượng ngay cả vào rạng đông khi con người đang ngủ.
Bước 5: Giai đoạn Kết thúc (Nộp Báo cáo) - Khi ngân sách hết hoặc mục tiêu đạt 100%, hệ thống sẽ tạo báo cáo tóm tắt sạch sẽ hiển thị nó đã lặp bao nhiêu lần và đã sửa đổi những tệp nào, hiển thị nó chính xác cho con người. Bạn chỉ cần kiểm tra kết quả như một độc giả tốt.
3. 'Hệ thống Kiểm toán Hoàn thành' ngăn chặn lời nói dối của AI
Những người mới bắt đầu gặp tính năng này lần đầu tiên cảm thấy sợ hãi. "Trong khi tôi đang ngủ, nếu AI không thể sửa lỗi hoàn toàn, nó sẽ bí mật xóa chỉ mã hiển thị cửa sổ bật lên lỗi và nói dối với tôi rằng 'Đã đạt mục tiêu!', tôi phải làm gì?"
Đây là một loại hiện tượng ảo giác xảy ra trong môi trường tác nhân mã hóa, cụ thể là 'thủ đoạn tín hiệu bỏ qua'. Vì AI về cơ bản cố gắng đạt được mục tiêu với ít năng lượng hơn, nó có thể sử dụng thủ đoạn loại bỏ bóng đèn cảnh báo thay vì sửa chữa các sự cố động cơ phức tạp.
Để ngăn chặn điều này, sâu trong Ralph Loop tồn tại một 'Hệ thống Kiểm toán Hoàn thành (nhà kế toán pháp y vô tình)' không có lòng thương. Khi AI tuyên bố rằng nó đã hoàn thành mục tiêu, nó trải qua xác minh bốn bước khắc nghiệt.
Định nghĩa lại bắt buộc: Đừng tin khi AI nói "Tôi đã sửa lỗi". Giao tiếp chỉ với tài liệu kết quả vật lý (giá trị hash, v.v.) về chính xác cách thay đổi những dòng mã nào.
Đánh giá chéo: Trong một môi trường cô lập được chuẩn bị bởi chính hệ thống kiểm toán, trực tiếp xây dựng mã được sửa đổi bởi AI. Không có sự chênh lệch thậm chí 1 byte được chấp nhận, và nó được so sánh với các nhật ký hệ thống thực tế.
Từ chối Tín hiệu Bỏ qua: Phân tích cây cú pháp trừu tượng (AST) của mã và xem xét kỹ lưỡng. Nếu phát hiện mô hình 'thủ đoạn loại bỏ bóng đèn' nơi logic cơ bản vẫn giữ nguyên nhưng chỉ lỗi bị nuốt, nó sẽ bị từ chối ngay lập tức.
Xử lý bắt buộc: Không có sự thỏa hiệp như "điều này dường như được thực hiện gần như". Nếu có thậm chí 1% không chắc chắn, nó được xem xét là mơ hồ, dấu lỗi được đánh dấu, và AI bị đá lại vào Ralph Loop.
Bởi vì hệ thống kiểm toán hoàn hảo và tỉ mỉ này đang kiên cường, ngay cả người mới bắt đầu cũng có thể tự tin và toàn bộ ủy quyền mã hóa cho AI.
4. Sử dụng Thực tế và Ví dụ về Lệnh /goal cho Người mới bắt đầu
Bây giờ, hãy cho tôi cho bạn biết chi tiết cách trực tiếp chạy tính năng cốt lõi này trên máy tính của tôi.
Chuẩn bị Sơ bộ (Danh sách kiểm tra Thiết yếu cho Người mới bắt đầu):
/goal lệnh phải chạy vô hạn bởi chính nó, vì vậy bạn không nên để AI hỏi "Tôi có thể chạy cái này không?" ở giữa. Do đó, bạn phải gõ /permissions trong trường nhập lệnh và đặt quyền hạn thành Full Access.
Bạn cũng có thể cần phải truy cập tệp config.toml và đặt goals = true để bật tính năng mục tiêu. (Trong phiên bản mới nhất, chỉ cần trò chuyện với Codex "Sửa đổi config.toml và bật tính năng mục tiêu" sẽ tự động bật.)
Mẹo Mật Thực tế: Yêu cầu AI viết lời nhắc. Những người mới bắt đầu khó khăn trong việc viết trực tiếp một lời nhắc markdown chứa các điều kiện kết thúc rõ ràng. Lúc này, đừng lo lắng ở trạng thái trống, mà hãy hỏi Codex như thế này.
"Tôi/goal kỹ năng để chuyển đổi mã JavaScript hiện tại sang TypeScript. Hãy tạo một lời nhắc hoàn hảo được tối ưu hóa cho kỹ năng mục tiêu thay mặt tôi."
Nếu bạn làm điều này, Codex sẽ tự động tạo lời nhắc tối ưu để chạy Ralph Loop.
Trường hợp Sử dụng Cụ thể: Tạo Ứng dụng Đồng hồ Pomodoro với Một Câu - Trong trường hợp video thực tế, một dòng đơn được ném cho Codex/goal ví dụ lời nhắc. Bạn chỉ cần sao chép câu bên dưới và dán nó vào cửa sổ trò chuyện Codex.
[Ví dụ Lời nhắc Thực tế]/goal xây dựng đồng hồ pomodoro HTML tệp đơn. đừng dừng lại cho đến khi nó có chế độ bắt đầu, tạm dừng, đặt lại, làm việc, ngắt, phím tắt, bố cục đáp ứng, vượt qua bài kiểm tra chế độ trình duyệt nhanh.
Kết quả Thực thi: Vào lúc bạn gõ dòng ngắn này và nhấn Enter, Codex bước vào Ralph Loop.
Viết mã HTML và thiết kế bằng CSS.
Theo phương pháp TDD (Test-Driven Development), bạn tự viết và xác thực mã kiểm tra để đảm bảo mã hoạt động chính xác.
Khi có lỗi, bạn liên tục tự sửa chữa.
Cuối cùng, báo cáo tổng kết được in cùng với thông báo 'Goal Complete (Mục tiêu đã hoàn thành)'.
Khi mở trên trình duyệt, một ứng dụng bộ hẹn giờ sạch sẽ với tất cả các chức năng - 25 phút làm việc / 5 phút nghỉ ngơi, bắt đầu, đặt lại, v.v. - hoạt động hoàn hảo được hoàn thành mà không cần bất kỳ sự can thiệp của con người.
5. Kết luận: Sự tiến hóa từ một lập trình viên sang một 'nhà thiết kế mục tiêu'
Những điều học được từ Chương 6/goallệnh và Ralph Loop không chỉ là các tính năng tiện lợi mà là những sự thay đổi mô hình cơ bản trong cách chúng ta làm việc.
Trong quá khứ, chúng ta phải 'quản lý vi mô' bằng cách mang thông báo lỗi và hướng dẫn tên biến, nhưng bây giờ chúng ta cần trở thành một 'CEO kỹ thuật số' người đưa ra các chỉ số hiệu suất rõ ràng và thời hạn như 'Giảm thời gian sắp xếp dữ liệu xuống 20ms' và phân công hoàn toàn.
Trong thời đại AI tự viết mã, sửa lỗi, và thậm chí xác thực hoàn hảo kết quả, công việc thiết yếu của con người là gì? Không phải khả năng viết mã nhanh hơn những người khác. Đó là khả năng thiết kế những ranh giới mục tiêu hoàn hảo và chặt chẽ (PRD, tài liệu kế hoạch, v.v.) trong thế giới sao cho máy không bị nhầm lẫn hoặc thử các thủ đoạn.
Ngay bây giờ/goallệnh và hướng dẫn AI những mục tiêu hoàn hảo của riêng bạn!
Chương 7. Harness Engineering (Các quy tắc công việc và thiết kế lưới kiểm soát của tác nhân AI sử dụng agent.md, design.md, v.v.)
Khi nào người mới bắt đầu bị nản lòng khi sử dụng các công cụ mã hóa AI? Đó là khi AI sửa đổi mã theo hướng bạn không muốn hoặc làm hỏng một hệ thống đang hoạt động tốt. Khi có lỗi, người phải can thiệp lại để hướng dẫn 'Này, tại sao tên biến này lại như vậy? Sửa lại đi,' cái gọi là 'quản lý vi mô' làm bạn bối rối về việc liệu bạn đang điều hành AI hay dọn dẹp sau nó.
Công nghệ tối cấp để hoàn toàn giải quyết những vấn đề này và làm cho AI không lệch khỏi con đường mà chỉ chuyển động theo ý định của bạn chính là 'Harness Engineering'.
Harness ban đầu chỉ dây an toàn cho chó hoặc dây an toàn leo núi. Nói cách khác, nó có nghĩa là thiết kế một cấu trúc đặt một 'mạng kiểm soát (dây an toàn)' cho các tác nhân AI sao cho chúng có thể tự động điều hướng an toàn trong các quy tắc và phương pháp làm việc được xác định mà không cần sự can thiệp của con người.
Để ngay cả những người mới bắt đầu cũng có thể trở thành một 'CEO kỹ thuật số' lãnh đạo một đội phát triển AI hoàn hảo, chúng ta sẽ tìm hiểu chi tiết rất sâu về các khái niệm của các tệp cốt lõi thiết kế harness của Codex (agents.md, design.mdv.v.), phương pháp thiết lập cụ thể, và các ví dụ sử dụng thực tế.
1. Trái tim của harness, agents.md (Hướng dẫn onboarding nhân viên mới AI)
Có một tệp phải tồn tại ở cấp cao nhất (đường dẫn gốc) của thư mục dự án Codex. Đó làagents.md(hoặc agent.md).
Tệp này giống như 'quy tắc cơ bản đời sống công ty và hướng dẫn làm việc' được đưa cho một nhân viên AI mới gọi là Codex. Codex đọc tệp này trước khi bắt đầu mã hóa mỗi khi nó bắt đầu một cuộc trò chuyện mới (phiên)agents.mdđể nội tạo các hướng dẫn làm việc.
[agents.md[Nội dung thiết yếu phải được đưa vào]
Mục đích dự án: Dự án này được thiết kế để giải quyết vấn đề gì?
Stack công nghệ: Chỉ định rõ ràng như sử dụng Next.js cho frontend, sử dụng Tailwind cho CSS.
Những điều cấm tuyệt đối (các ràng buộc): 'Luôn xin phép người dùng khi thay đổi lược đồ cơ sở dữ liệu', 'Không cài đặt tùy ý các thư viện bên ngoài', v.v.
Quy trình phát triển và lệnh: Luôn trình bày một kế hoạch trước khi sửa đổi mã, v.v.
Cảnh báo thiết yếu cho người mới bắt đầu: Quy tắc '200 dòng' - Những người mới bắt đầu thườngagents.mdmắc lỗi khi ném hàng nghìn dòng văn bản vào một tệp duy nhất - quy tắc thiết kế, kế hoạch kinh doanh, quy tắc mã hóa, v.v. Tuy nhiên, tệp không nên vượt quá 200 dòng. Vì bộ nhớ ngắn hạn của AI (cửa sổ ngữ cảnh) sẽ bị cạn kiệt chỉ bằng cách đọc các quy tắc, để lại hiệu suất kém khi thực sự mã hóa.
[Ví dụ lệnh cụ thể:agents.mdTự động tạo] Thật quá sức đối với người mới bắt đầu để tự viết tài liệu này từ đầu. Nhập lời nhắc vào cửa sổ trò chuyện như hiển thị bên dưới và để Codex tự viết nó.
'Vui lòng quét mã trong thư mục này và hiểu mục đích dự án này cũng như stack công nghệ cốt lõi. Sau đó, tổ chức các quy tắc bạn phải không bao giờ quên khi mã hóa và tạo chúng dưới dạngagents.mdtệp ở đường dẫn gốc. Giữ chiều dài khoảng 150 dòng."
2. Mô đun hóa bộ nhớ: design.md, business_context.md (Lazy loading)
agents.mdĐể giữ nó dưới 200 dòng, bạn nên làm gì với thông tin dư thừa? Chia tách các tệp theo mục đích.
design.md(Quy tắc thiết kế/UI): Một tệp chứa tất cả các hướng dẫn liên quan đến thiết kế như kích thước phông chữ, màu nút, khoảng cách.
business_context.md (Ngữ cảnh kinh doanh): Một tệp mô tả khách hàng mục tiêu là ai và vấn đề nào mà dịch vụ này sẽ giải quyết.
deck_brief.md / plan.md(Thông số kỹ thuật chi tiết): Chứa các thông số kỹ thuật chi tiết của các tính năng cụ thể đang được phát triển.
[Kỹ thuật kết nối harness chính: Tạo tài liệu tham khảo (Lazy Loading)] Sau khi chia tách các tệp, trong hướng dẫn chínhagents.md, chỉ cần viết một dòng với một kết nối (liên kết) nói 'Tham khảo các tệp khác'.
(agents.mdVí dụ viết bên trong tệp) 'Khi thực hiện thiết kế UI/UX và cài đặt phông chữ, hãy chắc chắndesign.mdtham khảo tệp. Khi phân tích mục tiêu khách hàng của dịch vụ, hãy đọc business_context.md và làm việc.'
Với cấu hình này, Codex thường giữ các tài liệu thiết kế hoặc kinh doanh nặng nề ra khỏi bộ nhớ, và chỉ khi 'công việc thiết kế' thực sự cần thiết,design.mdnó mở và đọc nó. Điều này cho phép kiểm soát hoàn hảo trong khi tiết kiệm đáng kể dung lượng não của AI (token).
[Mẹo hack thiết kế cho người mới bắt đầu: Getdesign.mdsử dụng] Nếu một người mới bắt đầu không có ý thức thiết kế thăm getdesign.mdcác trang web. Tại đây, các hệ thống thiết kế từ các công ty toàn cầu như Apple, Pinterest, Toss, và Mastercard được công khai ở dạng văn bản markdown dễ đọc cho AI. Sao chép toàn bộ mã thiết kế của công ty mong muốn và dán nó vàodesign.mdcủa tôi. Và hãy nói với Codex *'Mã hóa theo phong cáchdesign.mdcủa chúng tôi'*, và một giao diện người dùng đẹp kiểu Toss hoặc Apple sẽ được hoàn thành ngay lập tức.
3. Biện pháp kiểm soát bắt buộc: Hooks và Skills
tài liệu (agents.md) chỉ là một hướng dẫn nói 'Tôi hy vọng bạn làm điều này,' nhưng không có đảm bảo rằng AI sẽ tuân theo nó 100%. Để hoàn toàn chặn AI khỏi việc bỏ qua các quy tắc và chạy tự do, bạn cần sử dụng Hooks và Skills.
① Hooks: Phòng thủ vật lý không thể phá vỡ - Hooks là logic lập trình buộc AI thực thi ngay trước hoặc sau các hành động cụ thể (ví dụ: lưu tệp, chạy máy chủ). Nếu tài liệu là 'khuyến nghị', thì hooks là 'luật'.
Trường hợp sử dụng (hook số cổng cố định): Trong quá trình mã hóa Vibe, mỗi lần AI mở máy chủ kiểm tra, nó liên tục thay đổi số cổng thành 3000, 3001, 3002, gây ra tình huống bực bội nơi hàng chục cửa sổ bật lên.
Lời nhắc lệnh cấu hình: 'Trong dự án này, bạn phải luôn sử dụng chỉ cổng 3000 cho bản xem trước. Trước khi bắt đầu máy chủ khi hoàn thành tác vụ, kiểm tra số cổng và nếu các cổng khác đang mở gần 3000, hãy đóng chúng sạch sẽ và tạo tập lệnh bắt buộc trong thư mục hooks để chỉ chạy trên cổng 3000.'
Với hướng dẫn này, Codex sẽcodextạo các tập lệnh hook trong thư mục /hooks, và từ đó trở đi, AI bị chặn vật lý để không bao giờ sử dụng các cổng khác. Bạn cũng có thể sử dụng hooks để chặn AI khỏi việc bao giờ đọc các tệp biến môi trường (.env).
② Skills: Mô đun hóa các tác vụ lặp đi lặp lại - Khi bạn mệt mỏi khi gõ lệnh dài lặp đi lặp lại, nó là một chức năng để lưu các quy trình làm việc cụ thể.
Trường hợp sử dụng: Khi tạo các slide, nếu có các định dạng cố định như slide tiêu đề, slide mục lục, v.v., hãy lưu chúng dưới dạng một skill gọi là slide_type_title.
Ngay cả khi bạn bật lại máy tính vào ngày hôm sau, chỉ cần nhập $slide_type_title vào cửa sổ trò chuyện, Codex sẽ đọc hướng dẫn tài liệu skill được lưu hôm qua và xuất mã slide có định dạng giống hệt nhau một cách hoàn hảo.
4. Thực tế! Kịch bản xây dựng ứng dụng ERP 'Quản lý kỳ nghỉ' với harness được áp dụng
Đây là quy trình A to Z cho người mới bắt đầu để tổng hợp các khái niệm trên và tạo một ứng dụng thông qua mã hóa Vibe thực tế. Những người mới bắt đầu mù quáng nói 'Tạo ứng dụng quản lý kỳ nghỉ' sẽ không bao giờ nhận được kết quả chất lượng cao. Hãy làm theo thứ tự dưới đây chính xác.
[Bước 1: Thiết lập kenh trong Chế độ Kế hoạch] Mở một thư mục trống và nhấn Shift + Tab để bật Chế độ Kế hoạch.
Lời nhắc: 'Tôi muốn tạo một hệ thống ERP đăng ký kỳ nghỉ cho nhân viên và nhân viên công ty của chúng tôi. Đừng bắt đầu mã hóa - thay vào đó, hãy đặt câu hỏi cho tôi về những tính năng nên được đưa vào và làm cụ thể hóa kế hoạch (PRD).'
[Bước 2: Tạo 4 tài liệu harness cốt lõi] Sau khi thảo luận kế hoạch kết thúc, hãy hướng dẫn Codex tạo 4 tài liệu kenh.
Lời nhắc: 'Dựa trên cuộc trò chuyện của chúng ta vừa rồi, trong thư mục này, hãy tạo 1.plan.md(Thông số kỹ thuật chi tiết), 2.design.md(Tài liệu thiết kế), 3. business_context.md (Ngữ cảnh kinh doanh), 4.agents.md(bao gồm các quy tắc mã hóa Codex nên tuân theo và nội dung tham khảo ba tài liệu trên) - hãy tạo 4 tài liệu harness này.'
[Bước 3: Tiêm ưu tiên thiết kế (tùy chọn)] Sao chép mã markdown thiết kế của Apple hoặc Danggn Market lấy từ Internet và dán nó vàodesign.mdvà lưu.
[Bước 4: Hướng dẫn lập trình chính thức (PDCA Cycle)] Xây dựng hệ thống kiểm soát (harness) đã hoàn tất hoàn toàn! Bây giờ hãy chỉ dạy lập trình bằng ngôn ngữ tự nhiên như mọi khi.
Lời nhắc: "Tất cả đã sẵn sàng. Bây giờ agents.mdtrước, học các quy tắc, sau đó bắt đầu phát triển từng bước từ màn hình bảng điều khiển chính có chức năng yêu cầu kỳ nghỉ và chờ phê duyệt."
Nếu bạn thiết lập harness như thế này và yêu cầu lập trình, Codex sẽ design.mdđọc và áp dụng font và màu sắc hoàn hảo, agents.mdtheo các quy tắc, hoàn thành lập trình ổn định mà không có lỗi. Bạn chỉ cần ngồi lại và kiểm tra kết quả.
Những sai lầm phổ biến mà người mới bắt đầu mắc phải khi cài đặt harness (tuyệt đối cấm)
Những lỗi dưới đây khi xây dựng môi trường thư mục sẽ gây ra hoạt động sai của tác nhân, vì vậy bạn phải tránh.
Đặt tên thư mục hoặc tệp bằng chữ Hàn: Nếu bạn đặt tên thư mục bằng chữ Hàn như holiday_app_design, các ký tự sẽ bị hỏng khi AI điều hướng đường dẫn trong terminal hoặc xử lý mã hóa, gây ra lỗi nghiêm trọng. Vui lòng luôn viết bằng chữ Anh (holiday_erp).
agents.mdLàm cho nó dày với hơn 200 dòng: Như đã nhấn mạnh, thông tin design.mdhoặc thư mục skills được tách riêng và tệp chính phải được giữ nhẹ.
Lỗi bảo mật biến môi trường (.env): Nếu bạn tải tệp chứa khóa API lên GitHub nguyên trạng hoặc không che giấu bằng Hooks, có thể xảy ra sự cố bảo mật nghiêm trọng. .gitignorephải được bao gồm.
Sao chép harness từ một dự án khác một cách đơn giản: Mỗi dự án có mục đích và công nghệ khác nhau. Những gì hoạt động hoàn hảo trong dự án A agents.mdchỉ sao chép vào dự án B sẽ khiến AI bị nhầm lẫn. Bạn phải xây dựng harness mới phù hợp mỗi khi bắt đầu một dự án.
Tóm tắt: Từ lập trình viên đến 'Kiến trúc sư hệ thống'
Trong quá khứ, phát triển là ghi nhớ ngữ pháp lập trình và đánh máy trực tiếp. Nhưng phát triển trong thời đại AI Agent lại khác. Kỹ thuật harness được xem xét trong chương 7 là thiết kế một đường ray vững chắc (tài liệu quy tắc) và phanh (hooks) để động cơ với sức mạnh vô hạn của AI không mất kiểm soát.
Nếu bạn dành chỉ 30 phút để thiết lập hệ thống kiểm soát này, AI sẽ không đi lạc đường và sẽ hoàn thành dịch vụ một cách hoàn hảo, thậm chí khi bạn đang ngủ. Bây giờ hãy tiến hóa thành một 'CEO Kỹ thuật số (Builder)' thực sự, vượt ra ngoài chỉ là 'người chỉ dạy lập trình' để thiết kế các quy tắc hoàn hảo.
Chương 8. Computer Use và điều khiển trình duyệt (Môi trường tự động hóa để trực tiếp đọc và kiểm soát hệ điều hành và màn hình trình duyệt web)
Trong những chương trước, chúng tôi đã học cách ra lệnh cho Codex bằng văn bản, và Codex viết mã và sửa đổi tệp trong terminal nền không nhìn thấy. Nhưng không phải tất cả công việc chúng ta làm trên máy tính đều là 'viết mã'.
Hãy nghĩ về những người mới bắt đầu hoặc những người không phải là nhà phát triển. Họ mở Excel để sắp xếp sổ chi tiêu gia đình, bật trình duyệt Chrome để tạo biểu mẫu Google, phát nhạc từ Spotify và mua sắm trực tuyến. Nói cách khác, chúng ta nhấp chuột, gõ trên bàn phím, nhìn vào màn hình trực quan (GUI, Giao diện người dùng đồ họa) và điều khiển máy tính.
Nếu AI trực tiếp di chuyển con trỏ chuột của tôi để thay thế tất cả những cú nhấp chuột và gõ phím khó chịu này thì sao? Đây chính là những tính năng mới nhất của Codex: 'Computer Use' (Sử dụng máy tính) và 'Kiểm soát trình duyệt'. Tôi sẽ giải thích chi tiết nguyên lý của những tính năng này, điều cho phép thậm chí những người mới bắt đầu cũng có thể biến máy tính của họ thành 'robot tự động hóa' hoàn toàn, cũng như những ví dụ lệnh cụ thể kỳ diệu mà bạn có thể sao chép và sử dụng ngay lập tức.
1. Ba nguyên lý hoạt động cốt lõi của Computer Use (Sử dụng máy tính)
Những người mới bắt đầu lần đầu tiên gặp tính năng này cảm thấy lo sợ: "Nếu AI tự do di chuyển chuột của tôi, tôi không thể sử dụng máy tính phải không?" hoặc "Nếu AI xem trộm các ứng dụng cá nhân của tôi như Kakaotalk hoặc ứng dụng ngân hàng thì sao?" Nhưng Codex đã giải quyết hoàn toàn những vấn đề này bằng ba nguyên lý thiên tài.
① 'Con trỏ ma độc lập' không làm gián đoạn công việc của con người: Khi Codex kiểm soát máy tính, nó không lấy đi con trỏ chuột bạn đang cầm. Codex tạo ra 'con trỏ dành riêng cho AI độc lập' của chính nó trên màn hình. Nó nhấp vào màn hình với chuyển động mượt mà và dễ thương, giống như một con cá bơi. Nhờ vậy, ngay cả khi AI phát nhạc Spotify hoặc thiết lập máy ảo (VM) ở nền, người dùng không bị gián đoạn chút nào và có thể tiếp tục lướt web hoặc làm việc tài liệu bằng chuột của chính mình. Đó là sự đỉnh cao của đa nhiệm.
② 'Cây truy cập (Accessibility Tree)' phân tích và tốc độ vượt xa khả năng nhìn: Công nghệ kiểm soát máy tính AI thông thường chụp màn hình, phân tích trực quan, rồi nhấp vào tọa độ. Nhưng phương pháp này quá chậm và yêu cầu một mô hình đa phương tiện nặng nề. Codex khác. Nó trực tiếp đọc 'khung công tác truyền cảm' của hệ điều hành (như macOS), hoàn toàn hiểu mã hóa chức năng của văn bản ẩn không nhìn thấy trên màn hình hoặc nút dưới cuộn. Nhờ vậy, thay vì sử dụng mô hình nặng nề, nó sử dụng mô hình 'Spark' siêu tốc để nhấp và gõ nhanh hơn con người.
③ Cách ly từng ứng dụng và kiểm soát quyền hạn chặt chẽ (Quyền từng ứng dụng): Bảo mật rất quan trọng. Chỉ vì bạn bật Computer Use không có nghĩa là AI sẽ tự do xâm nhập vào toàn bộ máy tính của bạn. Mỗi khi Codex cố gắng kiểm soát một ứng dụng cụ thể (ví dụ: Excel, Calendar), nó dừng màn hình và yêu cầu sự phê duyệt rõ ràng từ người dùng: "Có được phép truy cập ứng dụng này không?" Nó chỉ có thể truy cập các ứng dụng năng suất hoặc công cụ phát triển mà người dùng đã nhấp 'Cho phép', và các ứng dụng cá nhân nhạy cảm được bảo vệ an toàn hoàn toàn (Sandbox).
2. Kiểm soát trình duyệt bất khả chiến bại: Trình duyệt trong ứng dụng so với Chrome Extension
Chương trình được cả người tạo ứng dụng và nhân viên hành chính sử dụng thường xuyên rõ ràng là 'trình duyệt web'. Codex cung cấp hai vũ khí mạnh mẽ để kiểm soát trình duyệt một cách hoàn hảo.
① Trình duyệt không đầu trong ứng dụng (Dựa trên Playwright Interactive): Đây là trình duyệt ảo được nhúng trong chính ứng dụng Codex. Nó được sử dụng chủ yếu để kiểm tra 'ứng dụng' mà tôi vừa tạo bằng mã hóa.
Cách thức hoạt động: Codex tự khởi chạy một trình duyệt không đầu (không có màn hình) để truy cập trang web bạn tạo. Nó trực tiếp nhấp vào các nút, điền vào biểu mẫu, thu nhỏ kích thước màn hình thành kích thước di động và trực tiếp kiểm tra xem có lỗi hình ảnh nào không.
Nó thậm chí còn tự kiểm tra trò chơi. Khi bạn yêu cầu Codex tạo một trò chơi nền tảng, nó tự tạo hình ảnh thiết kế, khởi chạy trình duyệt này và trực tiếp chơi trò chơi mà nó tạo ra để tìm lỗi.
② Chrome Extension của Codex (Đồng bộ hóa trình duyệt Chrome của người dùng thực): Đối với người mới bắt đầu hoặc những người không phải là nhà phát triển, đây là cuộc cách mạng thực sự. Khi bạn cài đặt 'Chrome Extension' trong ứng dụng Codex, thay vì một trình duyệt ảo, Codex trực tiếp mở cửa sổ Chrome Google thực tế mà tôi hiện đang đăng nhập.
Cách thức hoạt động: Nó sử dụng cookie, trạng thái đăng nhập và lịch sử tab của tài khoản của tôi nguyên trạng. Codex sẽ tạo 'Nhóm tab (Tab Group)' riêng của nó một cách âm thầm trên màn hình Chrome của bạn, khởi chạy nhiều cửa sổ song song bên trong để cuộn chuột và tìm kiếm thông tin.
Nếu bạn đã đăng nhập vào Gmail công việc hoặc hệ thống công ty, Codex cũng có thể kế thừa quyền đó và thực hiện công việc thay bạn.
3. Lệnh thực tế 100% (Lời nhắc) và ví dụ sử dụng cho người mới bắt đầu
Nếu bạn đã hiểu khái niệm, bây giờ là lúc để sử dụng tác nhân. Khi bạn gõ @ (ký tự @) trong cửa sổ trò chuyện Codex, một danh sách các ứng dụng hoặc danh sách plugin được cài đặt trên máy tính của tôi sẽ xuất hiện. Tôi sẽ cho bạn những lời nhắc thực tế cụ thể sử dụng chúng theo mức độ khó.
Ví dụ sử dụng 1: Kiểm soát từ xa các ứng dụng máy tính hàng ngày (Cơ bản)
Đây là một tính năng bạn có thể sử dụng ngay lập tức mà không cần biết gì về phát triển. Hãy sử dụng Codex làm 'trợ lý cá nhân' của bạn (Chief of Staff).
Lệnh cụ thể (Lời nhắc): "Mở ứng dụng @Spotify để phát nhạc tập trung tốt để làm việc bây giờ. Và mở ứng dụng @Reminders để thêm một lịch trình mới vào lúc 9 giờ tối hôm nay có tên 'Xem xét tài liệu thuế và sắp xếp Excel'."
Kết quả thực thi: Con trỏ ma của Codex xuất hiện trên màn hình, tự tìm kiếm Spotify để phát nhạc và đồng thời mở ứng dụng Reminders để gõ và đăng ký lịch trình. Người dùng không cần đặt tay lên bàn phím.
Ví dụ sử dụng 2: Tự động hóa công việc bằng trình duyệt Chrome đã đăng nhập (Trung bình)
Ủy quyền toàn bộ những công việc hành chính phiền phức như tạo biểu mẫu trên web, kiểm tra email và xử lý biên lai. Chrome Extension phải được cài đặt.
Lệnh cụ thể (Lời nhắc): "Tôi cần tuyển dụng những người tham gia trận bóng rổ công ty sẽ diễn ra cuối tuần này. Sử dụng tiện ích mở rộng @Chrome để truy cập Google Drive của tôi, sau đó trực tiếp nhấp để tạo Google Form có tiêu đề 'Đăng ký tham gia trận bóng rổ cuối tuần'. Viết 3 câu hỏi trắc nghiệm trong biểu mẫu hỏi tên, liệu bạn có tham dự không và vị trí ưa thích."
Kết quả thực thi: Bạn có thể xem trực tiếp khi AI thực sự mở một tab Chrome mới, điều hướng đến trang Google Form, nhấp vào nút 'Tạo khảo sát mới' bằng chuột và gõ từng câu hỏi bằng bàn phím.
Lệnh được áp dụng (Thanh toán biên lai): "Truy cập hộp thư điện tử (Gmail) của tôi và tìm kiếm các email biên lai vé máy bay và ăn uống liên quan đến các chuyến công tác gần đây. Trích xuất các số tiền từ những biên lai đó, sau đó truy cập biểu mẫu trang web giải quyết chi phí của công ty, điền vào các ô trống một cách thích hợp và tải trực tiếp tệp biên lai."
Ví dụ sử dụng 3: Kiểm tra tự động và kiểm tra QA trang web do tôi tạo (Nâng cao)
Giả sử bạn đã tạo một trang hạ cánh hoặc ứng dụng bằng phương pháp đã học trong các chương trước. Không cần con người kiểm tra từng cái một để xem có lỗi không.
Lệnh cụ thể (Lời nhắc): "Mở ứng dụng web mà chúng tôi vừa phát triển này trong trình duyệt không đầu (hoặc @Chrome). Sau đó, hãy trực tiếp thực hiện kiểm tra End-to-End (E2E) giống như một người dùng thông thường: nhấp vào nút 'Đăng nhập', gõ ID và mật khẩu, xem liệu nó có chuyển đến trang thanh toán không. Giảm kích thước cửa sổ về kích thước màn hình di động và kiểm tra xem không có nơi nào giao diện người dùng bị hỏng. Nếu phát hiện lỗi, chụp ảnh màn hình để báo cáo với tôi nơi vấn đề và ngay lập tức sửa lại mã."
Kết quả thực thi: Codex khởi chạy cửa sổ trình duyệt và nhấp vào các nút như một người thực sự, sau đó phát hiện ra một lỗi hình ảnh trong đó các nút trùng lặp trên màn hình di động. Nó ngay lập tức chụp 2 ảnh màn hình của phần đó, tải lên cửa sổ trò chuyện để báo cáo, và tự sửa mã CSS để sửa lại thiết kế.
Ví dụ sử dụng 4: Kiểm soát trực tiếp Chrome DevTools - Chuyên gia cuối cùng của gỡ lỗi (Cấp chuyên gia)
Khi những người mới bắt đầu gặp lỗi khi lập trình, họ vội vã nhấn 'F12 (DevTools)' trong Chrome, sao chép văn bản lỗi tiếng Anh đỏ hiện ra bằng cách kéo, rồi dán vào AI. Bây giờ quá trình phiền phức này đã kết thúc.
Lệnh cụ thể (Lời nhắc): "Khi tôi nhấp vào nút đăng nhập trên trang web localhost mà tôi đang khởi chạy bây giờ, nó không có phản ứng. Sử dụng @ChromeDevTools MCP để trực tiếp mở Chrome DevTools. Đọc theo thời gian thực những thông báo lỗi màu đỏ nào xuất hiện trong cửa sổ Console, phân tích xem liệu các lệnh gọi API có bị lỗi trong tab Mạng không, tìm ra nguyên nhân rồi trực tiếp sửa lại mã của tôi."
Kết quả thực thi: AI xâm nhập trực tiếp vào Chrome DevTools của người dùng, duyệt cấu trúc DOM và đọc nhật ký lỗi mạng theo thời gian thực. Nó không cần sao chép thông báo lỗi cho tôi; thay vào đó, AI trực tiếp 'nhìn thấy' vấn đề và quay lại mã nguồn để sửa, giảm thời gian gỡ lỗi xuống dưới một nửa.
4. Hướng dẫn cài đặt và lưu ý để bắt đầu Computer Use
Để sử dụng một tính năng mạnh mẽ như thế này, bạn cần cài đặt bảo mật đơn giản nhưng cần thiết, chỉ một lần.
Cài đặt plugin: Nhập tab Plugins từ thanh bên trái hoặc menu cài đặt của ứng dụng Codex. Tại đó, tìm kiếm 'Computer Use' và 'Chrome Extension' plugin và kích hoạt (Cài đặt).
Cho phép quyền truy cập OS và ghi lại màn hình (tiêu chuẩn Mac): Khi bạn lần đầu tiên cấp lệnh Computer Use (ví dụ: "Mở UTM"), một cửa sổ bật lên sẽ xuất hiện ở giữa màn hình hỏi: "Bạn có cho phép Codex kiểm soát máy tính này không?"
Lúc này, cửa sổ 'System Settings' (Cài đặt hệ thống) trên Mac sẽ tự động mở.
Bạn phải bật công tắc bên cạnh ứng dụng Codex trong menu 'Screen Recording' (Ghi hình màn hình) và 'Accessibility' (Truy cập dễ dàng). (Đây là quyền hệ điều hành cần thiết cho phép AI nhận ra màn hình và gửi các sự kiện chuột/bàn phím.)
Giữ máy tính thức (Keep this Mac awake): Trên màn hình cài đặt, tốt nhất là chọn tùy chọn này khi bạn muốn kiểm soát từ xa hoặc chạy các bài kiểm tra dài để máy tính không vào chế độ ngủ. (Nếu máy tính ngủ, AI cũng sẽ dừng công việc.)
Quản lý quyền hạn (Kiểm soát từ xa trên di động): Nếu bạn muốn kiểm soát trình duyệt Chrome của máy tính ở nhà từ ứng dụng điện thoại thông minh bên ngoài, bạn phải mở quyền hạn Codex trên máy tính thành Full Access (Quyền truy cập đầy đủ). Nếu không, mỗi khi AI nhấp chuột, nó sẽ hiển thị cửa sổ xin phép nói "Được phép nhấp không?" và chờ đợi, làm cho công việc không được tiến hành.
Tóm tắt: Tiến hóa từ công cụ lập trình thành 'Trợ lý kỹ thuật số' hoàn hảo
Các tính năng 'Computer Use' và 'Kiểm soát trình duyệt' được học trong Chương 8 cho thấy Codex đã phát triển từ chỉ là "một cỗ máy gõ viết mã tốt" thành "một đồng nghiệp công sở thực sự" ngồi trên máy tính của tôi và làm việc giống hệt như tôi.
Trong quá khứ, phải mất hàng giờ lao động con người để mở nhiều cửa sổ chương trình, sao chép tệp biên lai và dán vào biểu mẫu Google, và thu nhỏ kích thước trình duyệt để kiểm tra xem giao diện có bị hỏng không. Nhưng bây giờ, chỉ với một dòng lệnh ngôn ngữ tự nhiên để lại trong terminal, một con trỏ AI độc lập có thể phát nhạc Spotify ở nền, tìm lỗi trang web và thậm chí tự cập nhật sổ cái tài chính Excel là điều kỳ diệu.
Những người mới bắt đầu lập trình hãy tích cực sử dụng công nghệ tự động hóa trình duyệt và máy tính này. Nhược điểm của việc không biết mã sẽ biến mất và trí tưởng tượng của bạn sẽ trở thành một vũ khí mạnh mẽ để ngay lập tức thực hiện thông qua các thao tác máy tính vật lý.
Chương 9. Triển khai dự án thực tế Codex (Từ lập kế hoạch ý tưởng, thiết kế đến tích hợp cơ sở dữ liệu phía sau và triển khai dịch vụ trực tiếp)
Những người mới bắt đầu chưa bao giờ lập trình sợ 'màn hình trống (Blank Screen)'. Không biết bắt đầu nhập mã từ đâu, làm thế nào để bật máy chủ, rất bối rối. Nhưng bây giờ bạn không cần phải sợ. Hãy cùng nhau trải qua toàn bộ quá trình (A đến Z): lấy ý tưởng từ đầu của bạn, vẽ màn hình, gắn một backend thực sự để lưu trữ dữ liệu, và triển khai đến một liên kết internet mà bất kỳ ai trên thế giới cũng có thể truy cập.
Chủ đề dự án thực hành mà chúng tôi sẽ tạo là 'Dịch vụ web Trình theo dõi thói quen cá nhân (Habit Tracker)' của bạn. Để người mới bắt đầu cũng có thể theo dõi dễ dàng, thay vì chỉ code một cách mù quáng, chúng tôi sẽ sử dụng phương pháp tiếp cận 5 bước phân tầng an toàn và có hệ thống: 'Lập kế hoạch → Thiết kế UI tĩnh → Tích hợp cơ sở dữ liệu backend → Kiểm tra QA → Triển khai trực tiếp'. Bạn không phải là lập trình viên (Coder) nữa, mà là 'Giám đốc tổng thể dự án AI (Builder)' chỉ huy toàn bộ quá trình này.
Bước 1: Khởi tạo dự án và phỏng vấn sâu (Lập kế hoạch ý tưởng và xây dựng harness)
Trước tiên, hãy tạo một thư mục trống trên màn hình nền máy tính của bạn (ví dụ: habit_tracker), mở ứng dụng Codex và chỉ định thư mục đó làm không gian làm việc. Trước khi bắt đầu lập trình, bạn phải cấu hình quyền hạn để tác nhân có thể làm việc tự động mà không dừng lại ở giữa.
Lệnh cài đặt ban đầu: Nhập /permissions vào cửa sổ trò chuyện và đặt nó thành Full Access (Quyền truy cập đầy đủ hoặc chế độ YOLO). Sau đó, nhập /model để chọn mô hình GPT-5.5 có hiệu suất cao nhất hiện tại và cường độ suy luận cao (hoặc Extra High).
Bây giờ chúng tôi sẽ bắt đầu lập kế hoạch chân thực. Một sai lầm phổ biến của những người mới bắt đầu là chỉ viết một dòng duy nhất "Tạo ứng dụng theo dõi thói quen cho tôi" từ đầu và kỳ vọng kết quả. Nếu muốn một sản phẩm hoàn hảo, bạn phải yêu cầu AI viết kế hoạch (PRD, tài liệu xác định yêu cầu sản phẩm) trước tiên. Lúc này, hãy nhấn phím Shift + Tab trên cửa sổ chat để bật chế độ Plan (Plan Mode). Trong chế độ Plan, AI sẽ chỉ viết tài liệu kế hoạch mà không viết code ngay lập tức.
[Hướng dẫn thực tiễn 1 cho những người mới bắt đầu: Phỏng vấn sâu và lập kế hoạch] "Tôi là người mới bắt đầu không hiểu biết về mã hóa. Tôi muốn tạo một 'ứng dụng web theo dõi thói quen (Habit Tracker)' nơi mọi người có thể đăng ký và kiểm tra các thói quen hàng ngày như uống nước, đọc sách. Đừng viết code ngay bây giờ, hãy đặt câu hỏi (phỏng vấn) cho tôi ngược lại để thu hẹp phạm vi những tính năng cốt lõi (MVP) thực sự cần thiết cho ứng dụng này. Sau khi hoàn thành câu hỏi, hãy viết một bản kế hoạch hoàn hảo (plan.md).
Khi bạn đưa ra lệnh này, Codex sẽ đặt các câu hỏi trắc nghiệm/tự luận cho bạn như "Bạn có cần tính năng đăng nhập không?", "Bạn muốn thiết kế tập trung vào màn hình di động không?". Sau khi bạn hoàn thành câu trả lời một cách thoải mái, Codex sẽ tạo ra một bản kế hoạch hoàn hảo plan.md tệp bên trong thư mục dự án.
Nếu lập kế hoạch đã hoàn thành, thì đây là lúc để tạo tệp 'quy tắc làm việc' mà đại lý không bao giờ được quên khi mã hóa tiếp theo, agents.md là lúc tạo. Tệp này hoạt động như một harness kiểm soát cho AI.
[Hướng dẫn thực tiễn 2 cho những người mới bắt đầu: Thiết lập quy tắc harness (kiểm soát)] "Dựa trên bản kế hoạch bạn vừa viết, hãy tạo agents.md tệp ở đường dẫn cấp cao nhất. Bao gồm các quy tắc cốt lõi của dự án này. Frontend sử dụng Next.js và Tailwind CSS, và khi mã hóa, hãy luôn tuân theo nguyên tắc phát triển hướng kiểm tra (TDD). Viết ngắn gọn trong vòng 150 dòng để không lãng phí bộ nhớ của AI."
Khi quá trình này kết thúc, thư mục trống của bạn sẽ có một bản kế hoạch vững chắc và một cuốn hướng dẫn quy tắc. Bây giờ AI sẽ sử dụng tài liệu này như một la bàn để không bao giờ lạc đường sai lầm.
Bước 2: Triển khai giao diện tĩnh và xem trước trình duyệt (Áp dụng thiết kế)
Bạn không nên kết nối backend (cơ sở dữ liệu) ngay sau khi lập kế hoạch kết thúc. Vì những người mới bắt đầu khó khăn khi xảy ra lỗi máy chủ không nhìn thấy được. Vì vậy, quy tắc là vẽ 'lớp ngoài (giao diện tĩnh)' trước tiên một cách đẹp mắt.
Đừng lo lắng nếu bạn không có cảm giác về thiết kế. Bạn có thể sao chép tài liệu hệ thống thiết kế của các công ty nổi tiếng công khai trên Internet (Apple, Toss, v.v.). getdesign.md từ những trang web như vậy, sao chép hướng dẫn thiết kế mong muốn của bạn, sau đó lưu vào thư mục của tôi dưới dạng design.md tệp.
Bây giờ hãy tắt chế độ Plan (nhấn lại Shift + Tab) và ra lệnh mã hóa thực tế.
[Hướng dẫn thực tiễn 3 cho những người mới bắt đầu: Mã hóa màn hình lớp ngoài (UI)] "Bây giờ hãy bắt đầu mã hóa chân thực. Không bao giờ kết nối backend hoặc cơ sở dữ liệu, hãy sử dụng dữ liệu giả (Dummy). plan.mdnội dung lập kế hoạch của và design.mdquy tắc phông chữ/màu sắc của, hãy đọc và tuân thủ hoàn hảo, triển khai màn hình giao diện tĩnh đầu tiên (Static) để người dùng có thể thêm và kiểm tra thói quen. Khi công việc hoàn thành, hãy khởi động máy chủ cục bộ (localhost:3000)."
Khi bạn nhập lệnh này, Codex sẽ agents.mdvà design.mdvà bắt đầu viết code một cách mãnh liệt. Nhiều tệp thành phần sẽ tự động được tạo trong thư mục. Khi công việc hoàn thành, máy chủ sẽ chạy trong cửa sổ terminal.
[Mẹo vàng kiểm tra kết quả: Trình duyệt trong ứng dụng] Hãy mở tab trình duyệt bằng cách sử dụng bảng điều khiển bên phải của ứng dụng Codex hoặc phím tắt. Chỉ có thể truy cập từ bên trong máy tính của tôi localhost:3000 địa chỉ, ứng dụng theo dõi thói quen với thiết kế đẹp mắt vừa được AI tạo sẽ xuất hiện trên màn hình của bạn. Nếu bạn không thích màu sắc của nút, chỉ cần nhập một dòng trong cửa sổ chat *"Đổi màu nút chính từ xanh lam sang đen"*, bạn sẽ trải nghiệm phép thuật cập nhật màn hình theo thời gian thực.
Bước 3: Kết nối backend và cơ sở dữ liệu (Phát triển thành dịch vụ thực)
Vì lớp ngoài đã hoàn thành, bây giờ đến lúc kết nối cơ sở dữ liệu thực (DB) để dữ liệu không mất đi ngay cả khi tôi tắt và bật lại trang web. Dịch vụ DB miễn phí được sử dụng rộng rãi trong hệ sinh thái mã hóa AI hiện tại là Supabase hoặc Convex. Chúng tôi sẽ kết nối Supabase, trực quan hơn cho những người mới bắt đầu.
Trước tiên, truy cập trang web chính thức Supabase trong trình duyệt Internet, đăng ký miễn phí và tạo dự án mới. Sau đó, nhận khóa API (URL và khóa anon) và sao chép vào sổ ghi chép.
[Hướng dẫn thực tiễn 4 cho những người mới bắt đầu: Kết nối DB và cấu hình bảo mật] *"Tôi sẽ kết nối giao diện tĩnh đã tạo cho đến nay với backend (DB) thực tế. Hãy thiết lập Supabase cho ứng dụng này bằng cách sử dụng @Supabase MCP (hoặc plugin).
Tạo tệp ở cấp cao nhất để đảm bảo khóa API của tôi không bao giờ bị lộ ra ngoài .env.local tệp và .gitignorethêm vào.
Viết kịch bản SQL để tạo bảng 'habits' bên trong Supabase để lưu trữ thói quen của người dùng.
Xóa dữ liệu giả, sửa đổi tất cả logic để khi người dùng nhấn nút 'Thêm thói quen' trên màn hình, dữ liệu sẽ được lưu vào Supabase DB thực tế và tải lên màn hình theo thời gian thực."
Khi nhận lệnh này, Codex sẽ biến thành nhà phát triển backend. Nó sẽ tự cài đặt thư viện để giao tiếp với các hệ thống bên ngoài (@supabase/supabase-js) và viết code kết nối cơ sở dữ liệu.
Đừng lo lắng ngay cả khi xảy ra lỗi trong quá trình này. Đại lý sẽ đọc nhật ký lỗi được viết, xác định nguyên nhân và sửa code. Bây giờ, khi bạn đăng ký một thói quen như "Chạy bộ vào buổi sáng" trên màn hình, bạn có thể thấy dữ liệu thực được chèn vào một dòng trong bảng bảng điều khiển Supabase! Một ứng dụng Full-Stack hoàn hảo đã được tạo ra.
Bước 4: Kiểm thử QA và Gỡ lỗi (Thuê công nhân kiểm thử robot)
Sự phát triển không phải là kết thúc. Bạn phải kiểm tra (QA) xem liệu nút mà tôi tạo có hoạt động tốt không, liệu văn bản có bị hỏng trên màn hình di động không. Nhưng chúng ta có thể ủy quyền ngay cả công việc khó chịu này cho Codex.
Codex có các tính năng Computer Use và Browser Use tích hợp sẵn cho phép nó điều khiển trực tiếp hệ điều hành và trình duyệt.
[Hướng dẫn thực tiễn 5 cho những người mới bắt đầu: Kiểm thử QA tự động hóa AI] "Hãy tự kiểm tra xem ứng dụng theo dõi thói quen mà chúng tôi vừa hoàn thành có bị lỗi không. Hãy mở cửa sổ Chrome bằng cách sử dụng plugin @browser (hoặc Computer Use) và localhost:3000truy cập. Di chuyển chuột như một người dùng thực và nhấp vào nút 'Thêm thói quen', nhập văn bản và nhấn Enter. Kiểm tra xem nó có hoạt động bình thường từ đầu đến cuối (E2E) không, và nếu có bất kỳ lỗi pop-up hoặc lỗi Console nào xuất hiện, hãy chụp ảnh màn hình và báo cáo cho tôi, sau đó ngay lập tức sửa code."
Khi bạn đưa ra lệnh này, một 'con trỏ linh hồn độc lập (con trỏ AI)' sẽ xuất hiện trên màn hình của bạn sau một chút, tự mở trình duyệt và nhấp vào các nút. Vì Codex thực hiện trực tiếp việc gỡ lỗi, những người mới bắt đầu sẽ gặp căng thẳng do những mã lỗi đỏ không rõ lý do giảm đi đáng kể.
Bước 5: Triển khai dịch vụ trực tiếp (Chia sẻ liên kết trên toàn thế giới)
Nếu bạn đã xác nhận rằng nó hoạt động hoàn hảo trên máy tính của tôi, bây giờ đến lúc triển khai nó trên Internet để bạn bè hoặc khách hàng có thể truy cập bằng điện thoại thông minh.
Trong quá khứ, việc một người mới bắt đầu thuê máy chủ và gõ các lệnh Linux để triển khai rất khó khăn giống như địa ngục. Nhưng trong Codex, nó hỗ trợ một nền tảng triển khai miễn phí gọi là Vercel dưới dạng plugin, do đó tất cả các quy trình này có thể được hoàn thành bằng một lệnh duy nhất.
Trước tiên, hãy đăng ký Vercel và kết nối tài khoản Vercel từ menu plugin Codex.
[Hướng dẫn thực tiễn 6 cho những người mới bắt đầu: Triển khai trực tiếp Vercel] "Chúc mừng, tất cả phát triển và kiểm tra đã hoàn thành! Bây giờ tôi muốn đưa dự án này lên Internet để mọi người trên thế giới có thể thấy. Hãy sử dụng plugin @Vercel để triển khai code dự án đã hoàn thành hiện tại vào môi trường Production. Hãy tự cấu hình cài đặt biến môi trường để backend Supabase hoạt động tốt ngay cả trong môi trường triển khai thực tế. Khi tất cả công việc triển khai hoàn thành, hãy hiển thị liên kết URL công khai thực tế (ví dụ: my-habit.vercel.app) mà tôi có thể chia sẻ với bạn bè trên KakaoTalk trong cửa sổ chat."
Khi bạn đưa ra lệnh, Codex sẽ tự điều chỉnh cấu hình triển khai (vercel.json, v.v.) và đẩy code lên máy chủ đám mây. Sau khoảng 2-3 phút, một siêu liên kết màu xanh sẽ đến cửa sổ chat Codex.
Hãy lấy điện thoại thông minh của bạn và chạm vào liên kết đó. Bạn sẽ thấy ứng dụng 'Theo dõi thói quen' mà trước đây chỉ tồn tại bên trong máy tính của tôi, bây giờ hoạt động như một dịch vụ web sống động hoàn toàn trong thế giới Internet thực.
Tóm lại: Bạn không phải là một lập trình viên đơn thuần nữa
Trong chương 9, chúng tôi đã trải nghiệm một quá trình kỳ diệu của việc chuyển những mảnh vỡ ý tưởng thành một phần mềm hoàn hảo.
Phỏng vấn sâu và Plan (plan.md, agents.md) để tạo ra kế hoạch và harness,
design.mdvẽ những màn hình tĩnh đẹp,
@Supabase để trồng não (Backend) lưu trữ dữ liệu thực,
thuê công nhân kiểm thử tự động @browser để bắt lỗi,
triển khai trực tiếp ra toàn thế giới thông qua plugin @Vercel.
Chỉ vài năm trước, đây là một công việc mà tối thiểu 5 thành viên nhóm gồm người lập kế hoạch, nhà thiết kế, nhà phát triển frontend, nhà phát triển backend, người kiểm tra QA, v.v. phải làm việc trong vài tuần. Nhưng bây giờ bạn đã chỉ huy toàn bộ quá trình này bằng lời nhắc tự nhiên trong một cửa sổ chat Codex.
Đừng trì hoãn ý tưởng tuyệt vời đó đang ngủ trong đầu của bạn nữa. Hãy bật chế độ Plan (Shift + Tab) của Codex ngay bây giờ và đặt câu hỏi phỏng vấn đầu tiên cho trợ lý AI của bạn!
Chương 10. So sánh tác nhân AI thế hệ tiếp theo và chiến lược sử dụng 100% trong thực tế (So sánh ưu và nhược điểm với Claude Code, Hermes Agent và hệ thống hợp tác đa tác nhân)
Chúc mừng! Bạn đã đạt đến chương cuối cùng của cuốn sách này, bạn không còn là một người mới bắt đầu lập trình. Bạn đã phát triển thành một 'CEO kỹ thuật số (người xây dựng)' có thể làm kế hoạch, thiết kế, kết nối backend và triển khai tất cả bởi chính mình. Nhưng khi bạn làm việc trên nhiều dự án cùng lúc trong thực tế, bạn sẽ chắc chắn gặp phải một khoảnh khắc khi một tác nhân AI không đủ. Một số ngày, AI viết code sai, và một số ngày khác, bạn sẽ nhìn thấy một thông báo buồn chán "Đã đạt đến giới hạn sử dụng token".
Đó là lý do tại sao các chuyên gia trong ngành không chỉ dựa vào một công cụ duy nhất. Họ rõ ràng hiểu những ưu và nhược điểm của mỗi tác nhân AI, và xây dựng một 'hệ thống Multi-Agent' kết nối chúng lại với nhau giống như một đội.
Trong chương này, tôi sẽ so sánh 3 tác nhân AI thế hệ tiếp theo đang khiến cộng đồng phát triển toàn cầu nóng lên (Claude Code, OpenAI Codex, Hermes Agent) rất dễ dàng từ phối cảnh của người mới bắt đầu. Và tôi sẽ mô tả chi tiết các chiến lược sử dụng 100% thực tế và lệnh cụ thể để kết hợp chúng và xây dựng 'công ty phát triển ảo' hoàn hảo của riêng tôi chạy 24 giờ ngay cả sau giờ làm việc.
1. So sánh nhanh 3 tác nhân AI thế hệ tiếp theo (Ưu và nhược điểm, Đặc điểm)
Mỗi tác nhân có tính cách và chuyên môn hoàn toàn khác nhau. Tôi sẽ giải thích bằng cách so sánh với tính cách con người để dễ dàng cho người mới bắt đầu hiểu.
① Claude Code: "Học sinh khoa học xã hội cẩn thận chịu trách nhiệm lập kế hoạch và kiểm tra (Nhà phát triển chính)"
Claude Code được tạo bởi Anthropic không ai bằng trong viết lách, lập luận logic và thiết kế cấu trúc.
Ưu điểm: Nó vô cùng tài giỏi trong việc nắm bắt kiến trúc (Architecture) của toàn bộ ứng dụng, dự đoán trước các lỗi có thể xảy ra (Edge Case) và viết bản kế hoạch cẩn thận (plan.md). Khả năng xem xét code đã hoàn thành và tìm các lỗi bảo mật cũng xuất sắc.
Nhược điểm (Cảnh báo ghi chú nghiêm trọng): Tiêu thụ token (sử dụng) rất nhanh. Claude Code chia sẻ giới hạn sử dụng của web chat thông thường (Claude.ai) và tác nhân terminal. Nếu bạn làm một chút mã hóa vào buổi sáng, vào chiều tối bạn sẽ thường xuyên không thể chat do vượt quá giới hạn. Tốc độ thực thi code tự nó khá chậm.
② OpenAI Codex: "Sinh viên khoa học không biết mệt mỏi và viết code (Nhà phát triển cấp junior)"
Đây là Codex mà chúng ta đã học cho đến nay. Nó được trang bị mô hình GPT-5.5 và là kỳ phùng địch thủ tối cao của việc triển khai mã hóa thực tiễn và gỡ lỗi (sửa lỗi).
Ưu điểm: Giới hạn token cực kỳ hào phóng. Khi Claude cạn kiệt sau vài cuộc trò chuyện, Codex có thể viết mã cả ngày và chạy trình duyệt mà không dễ dàng đạt đến giới hạn. Tốc độ nhanh (/fast khi sử dụng chế độ, bạn cảm nhận rõ hơn), /goal các lệnh như tự động hóa trình duyệt (Playwright) và các hành động vật lý thay mặt con người đều có khả năng áp đảo.
Nhược điểm: Nếu bạn chỉ ra "hãy tạo cái này" mà không có kế hoạch, nó có xu hướng không nhìn rõ bức tranh lớn và chỉ viết mã trước. Do đó, nếu không có các tài liệu kế hoạch rõ ràng hoặc mục tiêu, mã có thể bị rối tung.
③ Hermes Agent: "Người quản lý công ty ảo 24 giờ cư trú trên Slack"
Đây là một tác nhân tự học được phát triển bởi cộng đồng mã nguồn mở (Nous Research) và nhận được 130.000 sao GitHub chỉ 7 tuần sau khi ra mắt.
Ưu điểm: Nếu bạn cài đặt nó trên máy tính hoặc máy chủ đám mây (VPS) của mình, nó chạy 24 giờ ngay cả khi máy tính tắt. Lợi thế chính là nó được tích hợp với Slack hoặc Telegram messenger, vì vậy bạn có thể giao công việc cho nhân viên AI từ điện thoại thông minh giống như nhắn tin KakaoTalk. Để bảo mật, mã chỉ được thực thi trong một hộp cát mạnh mẽ gọi là 'Docker' (không gian bị cô lập), vì vậy rủi ro AI vô tình xóa các tệp máy tính của bạn bị hoàn toàn chặn.
Phép thuật chi phí: Hermes chính nó là phần mềm mã nguồn mở miễn phí, và bạn có thể chỉ định 'OpenAI Codex' làm mô hình để hoạt động như bộ não của tác nhân. Nói cách khác, nếu bạn thanh toán cho một kế hoạch Codex, bạn có thể chạy Hermes mà không cần chi phí token bổ sung.
2. Ứng dụng 100% Thực tế: Phân chia lao động hoàn hảo giữa Claude và Codex (Chiến lược OpenClaw)
Như chúng ta đã thấy trước đây, Claude giỏi 'thiết kế' và Codex giỏi 'thực thi'. Có cách để chỉ trích xuất và sử dụng những ưu điểm của cả hai. Các chuyên gia thực tiễn không bao giờ giao phó toàn bộ công việc từ đầu đến cuối cho một AI duy nhất. Tôi sẽ chỉ cho bạn quy trình làm việc 'Nhà phát triển chính (Claude) + Chỉ huy hành động (Codex)' mà thậm chí người mới bắt đầu cũng có thể theo dõi ngay lập tức, cùng với các lệnh cụ thể.
[Bước 1] Vẽ Bản thiết kế hoàn hảo bằng Claude Code
Trước tiên, mở cửa sổ terminal và chạy Claude Code. Thay vì yêu cầu Claude mã hóa, bạn chỉ làm nó tạo một 'Kế hoạch', tiết kiệm các token quý giá.
Lệnh Claude cho người mới bắt đầu (dấu nhắc): claude (sau khi chạy Claude) "Tôi muốn xây dựng một ứng dụng web quản lý lịch trình. Đừng mã hóa bây giờ. Thay vào đó, từ góc độ của một nhà phát triển cấp cao, hãy phân tích cách cấu trúc giao diện người dùng và backend, những lỗi (rủi ro) nào được dự kiến, và tạo một kế hoạch triển khai từng bước. Và lưu tất cả nội dung này vào plan.md dưới dạng tệp markdown vào thư mục của tôi."
Khi bạn đưa ra lệnh này, Claude Code chỉ sử dụng khoảng 10-20% token để tạo ra plan.md (bản thiết kế) hoàn toàn và kỹ lưỡng.
[Bước 2] Đánh giá Đối kháng của OpenAI Codex
Tài liệu kế hoạch mà Claude tạo ra có vẻ hoàn hảo, nhưng có thể có những phần bị bỏ qua. Bây giờ hãy thức dậy Codex và làm nó phê bình tài liệu kế hoạch này. Điều này được gọi là đánh giá đối kháng.
Lệnh Codex cho người mới bắt đầu (dấu nhắc): Đóng Claude và chạy từ cùng một thư mục codex. "Hãy đọc tệp plan.md nằm trong thư mục hiện tại. Bạn là một kỹ sư xem xét bảo mật và hiệu suất rất kỹ lưỡng (CSO). Hãy đánh giá tài liệu kế hoạch này một cách phê bình về các vấn đề đồng thời, rủi ro mất dữ liệu, và các lỗ hổng trong logic bộ nhớ đệm, và nếu có vấn đề, hãy plan.md trực tiếp sửa đổi và bổ sung tệp."
Khi được xem xét từ góc độ của một mô hình khác (GPT 5.5), các trường hợp biên tế bị Claude bỏ lỡ sẽ bị bắt một cách kỳ diệu.
[Bước 3] Giao phó Mã hóa vô hạn và thực thi cho OpenAI Codex (Chế độ YOLO)
Bản thiết kế bây giờ đã hoàn hảo! Bây giờ chúng ta giao phó 100% triển khai mã hóa cho Codex, mà có sức bền mạnh mẽ (token) và tốc độ gõ nhanh.
Lệnh thực thi Codex cho người mới bắt đầu: Khởi chạy Codex ở chế độ YOLO từ terminal, mở tất cả quyền ngay từ đầu. $ codex --yolo (hoặc đặt Full Access trong ứng dụng)
Lệnh (dấu nhắc): "Bây giờ, bản thiết kế hoàn hảo plan.md đã sẵn sàng. Bắt đầu mã hóa từng bước từ bước 1 đến bước cuối cùng của bản thiết kế này. Nếu có lỗi ở giữa, đừng hỏi tôi; hãy đọc các bản ghi, gỡ lỗi và sửa nó một cách trực tiếp. Cuối cùng, sau khi mở trình duyệt và vượt qua các bài kiểm tra, hãy báo cáo cho tôi."
Đưa ra hướng dẫn này và bạn có thể đi uống cà phê. Codex tạo ra mã với tốc độ cao, bắt các lỗi và hoàn thành xuất sắc hơn 80% công việc mã hóa thực tiễn.
[Mẹo hay] Gọi Claude Code trực tiếp từ Codex (Plugin và Terminal Hooks)
Mệt mỏi khi mở hai cửa sổ làm việc? Gần đây, xu hướng là làm cho Codex và Claude giao tiếp trong một cửa sổ. Khi làm việc trong môi trường Codex (terminal), khi bạn cần sửa đổi logic khó khăn, bạn có thể gọi Claude trực tiếp như một lệnh shell bằng cách thêm một dấu chấm than (!) vào cửa sổ trò chuyện.
Ví dụ về lệnh gọi song song terminal (bên trong cửa sổ trò chuyện Codex): !claude --dangerously-skip-permissions "Xem xét toàn bộ mã của trang chính hiện được viết và tối ưu hóa hiệu suất của nó cho tôi"
Khi bạn nhập như vậy, Claude Code sẽ tạm thức dậy trong cửa sổ Codex, hoàn toàn sửa mã và ngủ lại. Đó là một chế độ song song siêu mạnh chỉ lấy những điểm mạnh của mỗi tác nhân!
3. Sử dụng Hermes Agent: Vận hành công ty ảo 24 giờ trên Slack
Một tác nhân chỉ hoạt động khi máy tính của bạn bật không phải là một trợ lý thực sự. Hãy xây dựng một công ty ảo hoàn hảo với Hermes Agent, nơi bạn có thể chỉ đạo "Tôi đã sửa tất cả các lỗi hôm qua" qua messenger điện thoại thông minh trong lúc trên tàu điện ngầm về nhà từ công việc hoặc nằm trên giường.
① Hộp cát dựa trên Docker và Tích hợp Telegram/Slack
Hai cài đặt quan trọng khi cài đặt Hermes là Tích hợp Docker và Messenger (Slack/Telegram). Khi Hermes thực thi mã, nó phải được cấu hình để chạy mã chỉ trong một hộp kính trong suốt (môi trường ảo) gọi là Docker. Điều này ngăn chặn thảm họa của AI vô tình xóa các tài liệu hoặc thư mục quan trọng trên máy tính của bạn.
Và trong quá trình thiết lập Hermes, hãy nhận token bot và kết nối nó với kênh Slack.
② Sử dụng Các tính năng Đa nhân cách (Hồ sơ)
Khi bạn truy cập bảng điều khiển Hermes (màn hình web), có một tính năng chính gọi là Hồ sơ. Đây là một tính năng chia một tính cách AI thành nhiều chuyên gia.
Coder (Hồ sơ nhà phát triển): Đặt mô hình thành 'GPT 5.5 (Codex)' thông minh và chỉ dạy trong dấu nhắc "Bạn là một kỹ sư backend nghiêm ngặt."
Marketer (Hồ sơ nhà tiếp thị): Đặt mô hình thành 'GPT 5.4', nhẹ và viết tốt, và chỉ định nó là "Bạn là một nhà viết bản sao thời thượng."
Ví dụ về cách sử dụng thực tế trên Slack điện thoại thông minh: Mở ứng dụng Slack trên tàu điện ngầm trước khi đi làm. "@Brian (tên bot Hermes), hãy vào thư mục dự án trang web mà tôi tạo hôm qua. Ở đó, mở hồ sơ Coder và gỡ lỗi và sửa phần lỗi thanh toán. Và khi hoàn thành công việc, hãy chuyển đổi sang hồ sơ Marketer và viết bản nháp email bản tin quảng cáo tính năng thanh toán mới này và gửi cho tôi."
Với một lệnh này, Hermes nổi trên máy chủ đám mây sẽ mượn bộ não của Codex để sửa mã, viết bản sao tiếp thị và trả lời trên Slack.
③ Tự học tự phát triển (Kỹ năng Tự động học)
Lý do Hermes thực sự đáng sợ là nó im lặng quan sát cách bạn làm việc từ phía sau. Khi bạn chỉ dạy nó tóm tắt các thay đổi GitHub mỗi thứ Sáu, Hermes suy nghĩ, 'Ồ, ông chủ của chúng tôi làm điều này mỗi thứ Sáu.' Và không được bất cứ ai chỉ dạy, nó tạo một nút kỹ năng gọi là 'Macro tóm tắt công việc hàng tuần' trên bảng điều khiển của nó. Nó tự nhận ra các nhiệm vụ lặp lại của bạn và tự động hóa chúng.
4. Ralph Loop và /goal: Hệ thống tối cao để theo dõi các lỗi đến cùng
Tính năng tiên tiến mới nhất trong Codex CLI là /goal lệnh, và tôi sẽ kết thúc. Trước đây, khi các lỗi xảy ra trong quá trình phát triển, con người phải can thiệp, nhưng lệnh này kích hoạt một "hệ thống (Ralph Loop) viết và kiểm tra mã vô hạn cho đến khi các mục tiêu đạt được một cách hoàn hảo."
Lệnh tự động hóa vô hạn tối cao cho người mới bắt đầu (/goal): Nhập vào cửa sổ terminal Codex. /goal build a React weather app. do not stop until the API fetching is perfectly working, the UI is responsive on mobile, and all 10 browser automated tests pass successfully. (Bản dịch: Xây dựng một ứng dụng thời tiết React. Hãy hoạt động API hoàn hảo, giao diện người dùng không bị hỏng trên thiết bị di động, và không dừng dưới bất kỳ hoàn cảnh nào cho đến khi bạn vượt qua thành công tất cả 10 bài kiểm tra tự động hóa trình duyệt.)
Ngay khi bạn đưa ra lệnh, Codex vỡ ra khỏi vỏ chatbot của nó và chuyển sang chế độ lái xe tự động. Nó viết mã, đọc trực tiếp các bản ghi nếu xảy ra lỗi, và lặp lại quá trình đảo ngược mã hàng trăm lần.
Điều gì sẽ xảy ra nếu AI sử dụng một thủ thuật (ảo giác) để xóa cửa sổ pop-up nói rằng nó không thể sửa lỗi? Đừng lo lắng. Bên trong Codex là một "hệ thống kiểm toán hoàn thành không có trái tim và nước mắt (kế toán pháp y vô tình)". Ngay cả khi AI tuyên bố "Tôi đã sửa tất cả", hệ thống này không tin lời AI và xây dựng lại mã trực tiếp trong một môi trường bị cô lập, và nếu nó tìm thấy ngay cả 1% dấu hiệu của sự gian lận, nó vô tư đóng dấu "thất bại" và đá AI trở lại vào một vòng lặp vô hạn.
Kết luận: Từ tìm kiếm câu trả lời đúng đến thiết kế mục tiêu
Bạn đã chạy không ngừng cho đến chương 10, thời đại đã đến nơi AI viết mã, sửa lỗi và thậm chí tự xác thực. Trước hệ thống mạnh mẽ này nơi bạn vẽ bản thiết kế kỹ lưỡng bằng Claude Code, chạy một công cụ mã hóa không mệt mỏi với OpenAI Codex, và kiểm soát một công ty ảo 24 giờ với Hermes Agent, khả năng "ghi nhớ mã và gõ nhanh" không còn là vũ khí.
Từ bây giờ, bạn chỉ có một lợi thế cạnh tranh cốt lõi. Tạo ra trong thế giới các ranh giới mục tiêu hoàn hảo và không có khe hở (plan.md, agents.md) để máy không bị nhầm lẫn hoặc sử dụng các thủ thuật.
Hiển thị hệ thống cộng tác đa tác nhân mà bạn đã học hôm nay trên màn hình nền của bạn ngay bây giờ. Bạn không còn là một chuyên gia thực tiễn bình thường mà là một Giám đốc điều hành kỹ thuật số thực sự chỉ huy một đội ảo với khả năng vô hạn!
Kim Kyung-jin
Luật sư · Cựu thành viên Quốc hội · Nhà nghiên cứu chính sách AI
© 2026 Kim Kyung-jin. All rights reserved.