Bản dịch máy. Văn bản tiếng Anh là bản gốc có giá trị. English
Kỹ sư giúp AI agent của bạn an toàn khi chạy trên dữ liệu và tiền của khách hàng

Tôi thiết kế hệ thống và chỉ đạo AI xây dựng chúng. PANTHEON là một trong số đó: đa tenant, có quản trị, có đo lường, đang chạy production, do một mình tôi xây dựng.

Tôi thiết kế PANTHEON, cô lập đa tenant, quản trị, đo lường, an toàn agent, từ các nguyên lý cơ bản, rồi chỉ đạo AI xây dựng toàn bộ: một mình, đến production, chạy dữ liệu của các doanh nghiệp thật. Điều tôi mang lại là tư duy hệ thống để thiết kế nó, và kỷ luật để buộc máy móc chứng minh rằng nó hoạt động.

Isaac Teague Frayling · Cardiff, Vương quốc Anh · công dân Anh · sẵn sàng chuyển đến làm việc ở bất cứ đâu trên thế giới (cần bảo lãnh visa bên ngoài Vương quốc Anh & Ireland) · CV một trang →

↑ Ảnh hero, favicon, avatar và thẻ mạng xã hội trên trang này đều được tạo bởi hệ thống tôi xây dựng. Sản phẩm tự làm ra portfolio của chính nó.

Ghi nhận từ bên ngoài. Người báo cáo được ghi nhận (một trong bảy người) của CVE-2026-104850 (GHSA-6qxp-vccf-f47h), một khuyến cáo bảo mật mức độ cao (CVSS 7.5) trong MCP TypeScript SDK: OAuth client của SDK này có thể gửi thông tin xác thực đã lưu tới một máy chủ do máy chủ MCP chọn; đã được sửa trong 1.31.0 và 2.2.0. Đây không phải là sự xác nhận cho PANTHEON, mà là một lần kiểm tra do người khác thực hiện trên công việc của tôi.

đừng chỉ tin lời tôi

Mỗi tuyên bố ở đây đều dẫn tới một phép kiểm tra bạn có thể tự chạy.

Không slide, không "tin tôi đi." Hệ thống đang chạy thật, hãy thử phá nó, rồi cho người review code đằng sau nó theo NDA. Những gì tôi đã phát hành là thật và đang chạy, dù tôi có tự gõ một ký tự nào của nó hay không.

giá trị

Những gì tôi thực sự mang lại.

Tư duy hệ thống đứng vững trước tấn công

Tôi đã thiết kế cơ chế cô lập đa tenant nghiêm ngặt dựa trên row-level security của Postgres, hai vai trò, đóng khi lỗi (fails closed), mà chưa đợt kiểm định nào vượt qua được ở cơ sở dữ liệu. Một lỗ rò được phát hiện bên ngoài nó (lịch sử chat, tháng 7) và đã được sửa. Tôi không viết SQL. Tôi thiết kế mô hình: các kiểu lỗi, phạm vi ảnh hưởng, và dẫn dắt việc xây dựng cho đến khi nó đứng vững.

Tôi thiết kế AI có quản trị, không phải prompt chắp vá

Vòng lặp tác tử có quản trị, perceive → knowledge → tools → judge → meter, với các rào chắn, một quy trình xử lý khủng hoảng, cơ chế đo lường không thể chi vượt số dư và các cổng phê duyệt của con người, là thiết kế của tôi. Tư duy về control-plane là của tôi, AI viết mã theo đặc tả của tôi.

Từ ý tưởng đến production, bằng cách chỉ đạo AI

Substrate, một Studio no-code, nghệ thuật tạo sinh riêng, một kênh Telegram đang hoạt động (WhatsApp đã xây dựng, đang chờ Meta phê duyệt), đo lường, xác thực, tên miền tùy chỉnh. Tất cả là ý tưởng của tôi, tất cả được xây dựng bằng cách chỉ đạo AI, từ Postgres đến từng pixel, đã phát hành và đang chạy, một mình.

Tôi buộc máy phải chứng minh công việc của nó

Mọi thay đổi phải vượt qua một ranh giới thuần (purity boundary) được thực thi trong CI, số lượng theo lần chạy CI gần nhất bài kiểm thử, các đợt kiểm toán đối kháng lặp lại trong đó mọi phát hiện đều bị đem ra phản bác trước khi được tính. Điều khiển AI tốt nghĩa là từ chối tin nó, đó mới là kỹ năng thực sự.

Khả năng phán đoán, không chỉ đầu ra

Tôi phát hành phiên bản trung thực: mọi con số trên trang kiểm toán đều kèm dấu hoa thị của riêng nó, trang web nói thẳng những gì chưa được giải quyết, và sự an toàn: một tin nhắn khủng hoảng vẫn đến được nơi trợ giúp ngay cả khi còn 0 credit, được đặt trên chỉ số. Tôi thà được tin tưởng hơn là gây ấn tượng.

Tôi làm nhanh mà không phá vỡ các bảo đảm

Mọi năng lực mới đều giữ nguyên các bất biến: một bộ kiểm thử golden-file chứng minh các thay đổi an toàn đến từng byte, một sổ ghi chỉnh sửa giúp mọi thay đổi đều hoàn tác được, và bất cứ thứ gì thêm bề mặt mới đều phải qua một lượt kiểm tra bảo mật đối kháng trước khi triển khai. Tôi làm nhanh mà không để máy móc đi đường tắt.

phương pháp

Cách tôi xây dựng: phiên bản thật lòng.

Tôi quyết định hệ thống phải đảm bảo điều gì, rồi buộc nó chứng minh điều đó. Tôi thiết kế hệ thống và chỉ đạo AI xây dựng nó, và PANTHEON là kết quả của cách làm đó. Tôi đọc, đánh giá và debug mọi thứ máy tạo ra; tôi không tự gõ phần triển khai từ một file trống. Đây là hình dung tổng quát:

Tôi làm gì

Thiết kế hệ thống từ các nguyên lý cơ bản → chia nó thành các phần AI có thể xây dựng → chỉ đạo AI xây dựng từng phần → tấn công kết quả cho đến khi nó trụ vững → đưa vào vận hành và duy trì nó trong production. Đó là toàn bộ vòng lặp, từ đầu đến cuối.

Những khái niệm tôi nắm vững

Cách ly đa tenant & ranh giới tin cậy · các tầng quản trị & con người trong vòng lặp · đo lường nguyên tử & kiểm soát tốc độ · vòng lặp agent, công cụ & rào chắn · phòng thủ prompt injection · tư duy về chế độ lỗi & phạm vi ảnh hưởng. Tôi đã thiết kế tất cả những thứ này. Chỉ là tôi nói về chúng bằng ngôn ngữ đơn giản, không dùng thuật ngữ.

Các hệ thống tôi đã triển khai (và hiểu từ đầu đến cuối)

Postgres với row-level security · dịch vụ FastAPI · một vòng lặp agent có quản trị · MCP, cả hai chiều · frontend React · triển khai Docker / nginx. Tôi chỉ đạo việc xây dựng và tôi biết từng thành phần hoạt động thế nào.

Cách tôi giữ AI trung thực

ranh giới thuần trong CI · kiểm thử snapshot golden-file · số lượng theo lần chạy CI gần nhất bài kiểm thử đạt (lần chạy CI gần nhất) · các đợt kiểm toán đối kháng lặp lại: một đợt kiểm toán 50 agent và một đợt kiểm toán lại 14 góc nhìn, gần nhất, trong đó mọi phát hiện đều bị đem ra phản bác trước khi được tính. Bản năng nghi ngờ câu trả lời đầu tiên của máy chính là toàn bộ công việc.

Bằng chứng, kèm sẵn dấu hoa thị.

Tôi thà để bạn tin vào những phần có thật còn hơn là ấn tượng với những phần không có thật.

1bộ óc, không đội ngũ* thiết kế + chỉ đạo một mình
CIbài kiểm thử đạt* lần chạy CI gần nhất, không phải chứng minh hình thức
6 → 0kiểm toán · không còn lỗi critical nào tồn đọng* tự thực hiện, không phải bên thứ ba
đang chạytrong production, tenant thật* một instance duy nhất. Tôi chưa phải mở rộng quy mô nó
2 → 1doanh nghiệp, một xương sống* nền tảng, không phải bản demo, được chứng minh bằng lint

một quyết định tôi đã sai

Một ví dụ, bao gồm cả sai lầm của chính tôi.

Hai tuần trước tôi chọn kiểm tra các tin nhắn tiếng Anh về ngôn từ khủng hoảng chỉ bằng một danh sách cụm từ cố định, để phần lớn tin nhắn khỏi phải tốn thêm một lần gọi AI. Một đợt audit ngày 25 tháng 9 cho thấy danh sách đó bỏ sót "I don't want to live anymore" và ba cách diễn đạt phổ biến khác. Tôi đảo ngược quyết định trong cùng ngày: ngôn từ khủng hoảng giờ được chuyển đến bước kiểm tra AI, cả bốn đều là test đã thất bại trên mã cũ, và số tin nhắn thông thường phải trả cho lần gọi thêm giảm từ 4 trên 32 xuống 1. Khoản tiết kiệm đúng với phần lớn các bước kiểm tra và sai với đúng bước mà một lần bỏ sót có hậu quả nặng nhất.

thỏa thuận thẳng thắn

Bạn nhận được gì, và không nhận được gì.

Kiến trúc sư + người chỉ đạo

Tôi chịu trách nhiệm về tư duy hệ thống và việc đưa sản phẩm ra qua AI: quyết định xây gì, thiết kế cách để nó đứng vững, và đẩy nó cho đến khi được triển khai. Ghép tôi với các kỹ sư làm chủ phần tay nghề ở cấp từng dòng code mà tôi không có, và bạn có đủ cả hai nửa.

Kỷ luật mà AI tự nó không có

Mọi thay đổi quan trọng đều được rà soát theo kiểu đối kháng; tôi không bao giờ tin câu trả lời đầu tiên của máy. Hai điều mà bản năng đó mang lại: vụ rò rỉ giữa các tenant hồi tháng Bảy, do chính đợt kiểm tra của tôi phát hiện và nay đã thành một bài kiểm thử hồi quy, và khuyến cáo về MCP SDK ở trên, được phát hiện trong mã của người khác.

đề nghị

Điều tôi đang tìm kiếm.

Một vai trò: người chịu trách nhiệm ranh giới tin cậy của AI agent của bạn. Phân tách tenant, phê duyệt, đo lường sử dụng, công cụ tin tưởng bên gọi nó: tôi xác định chỗ nó có thể thất bại, đưa cơ chế đảm bảo vào ngay trong thiết kế, và đưa vào sử dụng bài kiểm thử chứng minh điều đó. Một nhân sự sáng lập hoặc nhân sự đầu tiên tại một startup có agent đang tiếp xúc với khách hàng thật, hoặc sắp như vậy. Tôi sẵn sàng chuyển đến bất kỳ đâu trên thế giới nếu đúng nơi phù hợp, và tôi quan tâm đến vấn đề và con người hơn là chức danh.

Vì sao là một công việc, mà không phải startup của riêng tôi?

Câu hỏi hợp lý. Tôi có thể gọi vốn cho PANTHEON, nhưng tôi biết chính xác nó thiếu gì, và đó không phải phần xây dựng. Đó là phân phối: mạng lưới và tầm với để đưa nó đến những doanh nghiệp mà nó được xây cho, thứ tôi không có và sẽ không giả vờ có. Tôi thà mang nó đến một đội đã có sẵn tầm với đó còn hơn mất nhiều năm để trở thành một nhà sáng lập mà tôi không phải. Tự mình xây nó đã chứng minh tôi có thể thiết kế và triển khai toàn bộ. Tự mình đưa nó ra thị trường chưa bao giờ là kế hoạch, PANTHEON vẫn chạy như một bằng chứng, không phải một dự án phụ chia nhỏ sự tập trung của tôi.

ngày đầu tiên

Đưa tôi một vấn đề, đây là việc tôi sẽ làm đầu tiên.

Không phải "làm quen công việc trong một quý." Chính phương pháp đã xây dựng PANTHEON, áp dụng vào sản phẩm của bạn:

Vẽ ranh giới tin cậy

Tìm các ranh giới về tenancy / phân quyền / phạm vi ảnh hưởng và xác định từng ranh giới thất bại ra sao, trước khi bất cứ thứ gì được xây dựng. Bạn không thể quản trị thứ mình chưa vẽ ra, và vẽ nó ra là việc tôi làm.

Tìm chỗ an toàn chỉ được gắn thêm vào sau

Tìm những biện pháp an toàn được thêm vào sau: bộ đo có thể bị thấu chi, hành động không có cổng kiểm soát, công cụ tin tưởng bên gọi nó, rồi thiết kế lại để sự bảo đảm được xây sẵn bên trong, chứ không phải gắn thêm vào.

Chỉ đạo việc xây dựng, rồi chứng minh nó

Viết đặc tả, chỉ đạo AI xây dựng, rồi phát hành kèm phép kiểm chứng: một bài test, một snapshot, một bất biến, để người đến sau có thể làm nhanh mà không phải chứng minh lại mọi thứ từ đầu.

Hãy trao đổi.

Hãy cho tôi biết vai trò và bạn đang xây dựng gì. Tôi đọc mọi email và trả lời trong vòng vài ngày, sau đó là một cuộc gọi, một buổi trình bày trực tiếp hệ thống, và review code theo NDA.

Muốn thử nghịch trước khi viết thư? Phá trợ lý, tấn công cơ chế cô lập, hoặc nhắn tin cho bot, tất cả đều đang chạy thật.

Không có LinkedIn. Hệ thống lõi là riêng tư: chính hệ thống đang chạy là portfolio, nhưng sáu thành phần đã được công bố trên PyPI và npm, hồ sơ lỗi được công khai, phương pháp có thể chạy lại, và tôi là một trong bảy người báo cáo được ghi danh trong một thông báo bảo mật của MCP SDK ở mức nghiêm trọng cao. Xem / tải CV của tôi →