làm tíai?GitHub ↗
CẨM NANG THỰC HÀNH

Harness Engineering

Toàn bộ bài giảng, dự án, tài nguyên, template và skill của Learn Harness Engineering, được dựng tĩnh để đọc liền mạch trong Tips.

Nội dung
33 chương
Thời lượng
305 phút đọc
Cập nhật
10 tháng 7, 2026
ĐỌC TỪNG PHẦN

Mục lục

Đọc theo thứ tự hoặc vào thẳng phần bạn cần.

Bắt đầu

  1. 01

    Chào mừng đến với Learn Harness Engineering

    Learn Harness Engineering là khóa học chuyên sâu về kỹ thuật dành cho các AI coding agent. Chúng tôi đã dày công nghiên cứu và tổng hợp những lý thuyết cùng thực tiễn tốt nhất về Harness…

    3 phút đọc

Bài giảng

  1. 02

    Bài 01. Mô hình mạnh không có nghĩa là thực thi đáng tin cậy

    Tính đến cuối năm 2025, các coding agent mạnh nhất trên SWE-bench Verified đạt tỷ lệ vượt qua khoảng 50-60%. Nghe thì có vẻ khá, nhưng đừng vội ăn mừng. Đó là những tác vụ được lựa chọn c…

    15 phút đọc
  2. 03

    Bài 02. Harness thực sự có nghĩa là gì

    Từ "harness" xuất hiện khắp nơi trong giới AI coding agent, nhưng thành thật mà nói, phần lớn thời gian khi người ta nói "harness", họ thực ra chỉ muốn nói đến một tệp prompt. Một tệp pro…

    15 phút đọc
  3. 04

    Bài 03. Biến kho lưu trữ thành nguồn sự thật duy nhất

    Các quyết định kiến trúc của nhóm bạn đang nằm rải rác khắp Confluence, Slack, Jira và đầu của vài kỹ sư cấp cao. Với con người thì cách này gượng gạo mà xong: bạn có thể hỏi đồng nghiệp,…

    16 phút đọc
  4. 05

    Bài 04. Chia hướng dẫn ra thành nhiều tệp

    Bạn đã bắt đầu nghiêm túc với harness engineering, điều đó tốt. Bạn tạo một AGENTS.md rồi nhồi vào đó mọi quy tắc, ràng buộc và bài học mà bạn nghĩ ra. Một tháng sau tệp phình lên 300 dòn…

    16 phút đọc
  5. 06

    Bài 05. Duy trì ngữ cảnh xuyên suốt các phiên

    Bạn yêu cầu Claude Code triển khai một tính năng hoàn chỉnh. Nó chạy 30 phút, xong phần lớn công việc, nhưng ngữ cảnh bắt đầu cạn. Bạn mở một phiên mới để tiếp tục, và phát hiện nó chẳng…

    17 phút đọc
  6. 07

    Bài 06. Khởi tạo trước mỗi phiên agent

    Bạn mở một phiên agent mới và nói "thêm tính năng tìm kiếm". Nó lao thẳng vào code, nhiệt tình đáng khen. 20 phút sau nó phát hiện khung test chưa cấu hình xong, mất thêm 10 phút sửa, rồi…

    16 phút đọc
  7. 08

    Bài 07. Vạch ranh giới tác vụ rõ ràng cho agent

    Bạn nói với Claude Code "thêm xác thực người dùng vào dự án này", và nó bắt đầu sửa schema cơ sở dữ liệu, viết route, thay đổi component frontend, và tiện thể tái cấu trúc luôn error-hand…

    13 phút đọc
  8. 09

    Bài 08. Sử dụng feature list để ràng buộc những gì agent làm

    Bạn yêu cầu một agent xây dựng một trang thương mại điện tử. Sau khi nó làm xong, nó báo "xong rồi". Bạn nhìn vào code: phần xác thực người dùng chạy ổn, nhưng nút thanh toán trong giỏ hà…

    14 phút đọc
  9. 10

    Bài 9. Ngăn chặn agent tuyên bố thành công quá sớm

    Bạn yêu cầu agent triển khai tính năng "đặt lại mật khẩu". Nó sửa schema cơ sở dữ liệu, viết API endpoint, thêm mẫu email, chạy unit test (tất cả pass) rồi đầy tự tin thông báo "xong rồi"…

    15 phút đọc
  10. 11

    Bài 10. Chỉ chạy toàn bộ pipeline mới tính là xác minh thật sự

    Bạn yêu cầu agent thêm tính năng xuất tệp vào ứng dụng Electron. Nó viết component cho renderer, preload script và logic lớp service. Unit test cho từng component đều pass. Agent báo "xon…

    15 phút đọc
  11. 12

    Bài 11. Làm cho runtime của agent có thể quan sát được

    Bạn yêu cầu agent triển khai một tính năng. Nó chạy 20 phút, sửa một đống tệp, rồi báo "xong, nhưng hai test đang fail". Bạn hỏi vì sao fail, "không chắc, có khi là vấn đề timing". Bạn hỏ…

    17 phút đọc
  12. 13

    Bài 12. Bàn giao sạch ở cuối mỗi phiên

    Agent của bạn chạy cả buổi chiều, sửa 20 tệp, commit code, rồi phiên kết thúc. Phiên agent tiếp theo vừa mở ra đã phát hiện ngay: build hỏng, test đang đỏ, các tệp debug tạm rải rác khắp…

    23 phút đọc
  13. 14

    Bài 13. Từ Nhắc lệnh Thủ công đến Vòng lặp Tự chủ

    Tất cả những gì bạn đã học trong mười hai bài đầu tiên đều dựa trên một giả định: bạn đang ngồi trước bàn phím, gõ các chỉ dẫn từng cái một.

    40 phút đọc

Dự án

  1. 15

    Chào mừng đến với Dự án

    Đây là phần thực hành của Learn Harness Engineering. Chỉ đọc các bài giảng là không đủ—bạn cần phải tự mình xây dựng các môi trường và quan sát cách Codex, Claude Code hoặc các AI agent k…

    2 phút đọc
  2. 16

    Dự án 01. Chỉ Prompt vs. Ưu tiên Quy tắc: Sự Khác biệt Lớn thế Nào

    Xây dựng một ứng dụng Electron knowledge-base shell tối giản — một cửa sổ với danh sách tài liệu bên trái, panel Q&A bên phải, và thư mục dữ liệu cục bộ. Bản thân tác vụ không phức tạp. Đ…

    2 phút đọc
  3. 17

    Dự án 02. Làm cho Dự án Có thể Đọc Được và Tiếp tục từ Nơi Đã Dừng

    Thêm "khả năng đọc được" vào repo để một agent mới có thể nhanh chóng hiểu cấu trúc dự án, biết tiến độ hiện tại, và tiếp tục công việc. Cụ thể: triển khai import tài liệu, document detai…

    2 phút đọc
  4. 18

    Dự án 03. Giữ cho Agent Tiếp tục Làm việc Qua Các Lần Khởi động Lại Phiên

    Thêm kiểm soát phạm vi và cổng xác minh vào agent. Triển khai document chunking, metadata extraction, hiển thị tiến độ indexing, và luồng Q&A dựa trên trích dẫn. Sử dụng featurelist.json…

    2 phút đọc
  5. 19

    Dự án 04. Sử dụng Phản hồi Runtime để Điều chỉnh Hành vi Agent

    Thêm observability runtime (log khởi động, log import/indexing, trạng thái lỗi) và các ràng buộc kiến trúc để ngăn chặn vi phạm xuyên lớp. Cài một lỗi runtime để agent sửa.

    2 phút đọc
  6. 20

    Dự án 05. Để Agent Xác minh Công việc của Chính nó

    Triển khai phân tách vai trò — một generator thực hiện, một evaluator review, và tùy chọn một planner. Chạy ba lần để đo lường tác động của mỗi vai trò được thêm vào.

    2 phút đọc
  7. 21

    Dự án 06. Xây dựng Harness Agent Đầy đủ (Capstone)

    Đây là dự án capstone. Tập hợp tất cả những gì đã học trong năm dự án đầu tiên, chạy một benchmark đầy đủ, sau đó thực hiện một lần dọn dẹp để xác minh chất lượng có thể duy trì được.

    2 phút đọc
  8. 22

    Dự án 07. Xây dựng Vòng lặp Tự động Đầu tiên

    Đây là dự án chuyển tiếp từ "Harness" sang "Loop." Bạn đã biết cách thiết lập một agent với môi trường, chỉ dẫn, và phản hồi phù hợp — bây giờ bạn sẽ biến thiết lập đó thành một vòng lặp…

    8 phút đọc

Tài nguyên

  1. 23

    Thư viện Tài nguyên

    Thư mục này chuyển đổi các phương pháp của khóa học thành các mẫu sao chép ngay và tài liệu tham khảo ngắn gọn mà bạn có thể sử dụng trong một kho lưu trữ thực tế.

    2 phút đọc
  2. 24

    Thư viện Mẫu

    Các mẫu harness sẵn sàng sử dụng cho các dự án agent.

    9 phút đọc
  3. 25

    Tài liệu Tham khảo Tiếng Việt

    Các ghi chú này giải thích cách sử dụng các mẫu như một harness làm việc thực thụ thay vì một đống tệp rời rạc.

    5 phút đọc
  4. 26

    Gói Harness Nâng cao OpenAI

    Gói này tập hợp thiết kế harness được mô tả trong bài viết "Harness Engineering" của OpenAI thành một bộ tệp bắt đầu có thể áp dụng và cấu trúc SOP đi kèm.

    3 phút đọc
  5. 27

    Mẫu Repo Nâng cao

    Sao chép starter này vào một kho lưu trữ thực khi bạn muốn một bề mặt tài liệu agent-first theo phong cách OpenAI thay vì chỉ một harness tối giản.

    13 phút đọc
  6. 28

    Chỉ mục Tài liệu Thiết kế

    Sử dụng chỉ mục này như bản đồ có thể khám phá của lịch sử thiết kế.

    2 phút đọc
  7. 29

    Kế hoạch Active

    Giữ một tệp markdown cho mỗi kế hoạch thực thi active trong thư mục này.

    1 phút đọc
  8. 30

    Kế hoạch Đã hoàn thành

    Di chuyển các kế hoạch đã hoàn thành ở đây thay vì xóa chúng. Các kế hoạch đã hoàn thành là một phần của bề mặt bộ nhớ kho lưu trữ và giúp các lần chạy agent sau hiểu tại sao mã trông như…

    1 phút đọc
  9. 31

    Chỉ mục Product Spec

    Sử dụng thư mục này cho các spec hành vi dành cho người dùng hiện tại.

    1 phút đọc
  10. 32

    Thư viện SOP

    Các quy trình vận hành chuẩn từng bước để thiết lập và vận hành harness.

    8 phút đọc

Skills

  1. 33

    Kỹ năng (Skills)

    Thư mục này chứa các bộ kỹ năng (skills) đi kèm với khóa học này. Các kỹ năng là các mẫu prompt độc lập có thể được nạp bởi các AI coding agent (Claude Code, Codex, Cursor, Windsurf, v.v.…

    3 phút đọc

Giấy phép nội dung

MIT License

Copyright (c) 2025 WalkingLab

Permission is hereby granted, free of charge, to any person obtaining a copy of this software and associated documentation files (the "Software"), to deal in the Software without restriction, including without limitation the rights to use, copy, modify, merge, publish, distribute, sublicense, and/or sell copies of the Software, and to permit persons to whom the Software is furnished to do so, subject to the following conditions:

The above copyright notice and this permission notice shall be included in all copies or substantial portions of the Software.

THE SOFTWARE IS PROVIDED "AS IS", WITHOUT WARRANTY OF ANY KIND, EXPRESS OR IMPLIED, INCLUDING BUT NOT LIMITED TO THE WARRANTIES OF MERCHANTABILITY, FITNESS FOR A PARTICULAR PURPOSE AND NONINFRINGEMENT. IN NO EVENT SHALL THE AUTHORS OR COPYRIGHT HOLDERS BE LIABLE FOR ANY CLAIM, DAMAGES OR OTHER LIABILITY, WHETHER IN AN ACTION OF CONTRACT, TORT OR OTHERWISE, ARISING FROM, OUT OF OR IN CONNECTION WITH THE SOFTWARE OR THE USE OR OTHER DEALINGS IN THE SOFTWARE.