Makine çevirisi. Esas alınan metin İngilizce olandır. English
Yapay zekâ ajanınızı müşterilerin verileri ve parası üzerinde çalıştırmayı güvenli hale getiren mühendis

Sistemler tasarlıyorum ve onları inşa etmesi için yapay zekâyı yönlendiriyorum. PANTHEON bunlardan biri: çok kiracılı, yönetişimli, ölçümlü, üretimde, tek başıma inşa edildi.

PANTHEON'u, yani çok kiracılı yalıtımı, yönetişimi, ölçümlemeyi ve ajan güvenliğini ilk ilkelerden yola çıkarak tasarladım, ardından tamamını inşa etmesi için yapay zekâyı yönlendirdim: tek başıma, üretime kadar, gerçek işletmelerin verileriyle çalışır halde. Getirdiğim şey, onu tasarlayacak sistem düşüncesi ve makineye çalıştığını kanıtlatacak disiplin.

Isaac Teague Frayling · Cardiff, Birleşik Krallık · Birleşik Krallık vatandaşı · dünyanın her yerine taşınmaya açık (Birleşik Krallık & İrlanda dışında vize sponsorluğu gerekir) · tek sayfalık CV →

↑ Bu sayfadaki hero görseli, favicon, avatar ve sosyal kartın hepsi benim kurduğum sistem tarafından üretildi. İş kendi portfolyosunu yaptı.

Dış atıf. CVE-2026-104850 (GHSA-6qxp-vccf-f47h) kaydında bildirimci olarak adı geçen kişiyim (yedi kişiden biri). Bu, MCP TypeScript SDK'daki yüksek önem dereceli (CVSS 7.5) bir güvenlik bildirimi: SDK'nın OAuth istemcisi, saklanan kimlik bilgilerini MCP sunucusunun seçtiği bir sunucuya gönderebiliyordu; 1.31.0 ve 2.2.0 sürümlerinde düzeltildi. Bu, PANTHEON'un bir doğrulaması değil; çalışmam üzerinde başka birinin yaptığı bir kontrol.

sözüme güvenmeyin

Buradaki her iddia, çalıştırabileceğiniz bir kontrole bağlanıyor.

Slayt yok, "bana güvenin" yok. Sistem canlı: gidin kırın, ardından arkasındaki kodu NDA kapsamında inceletin. Gönderdiğim şey gerçek ve çalışıyor, tek bir karakterini ben yazmış olsam da olmasam da.

değer

Gerçekte ne getiriyorum.

Saldırı altında ayakta kalan sistem düşüncesi

Postgres satır düzeyi güvenliği üzerine, iki rollü ve hata durumunda kapalı kalan (fail closed) katı bir çok kiracılı izolasyon tasarladım; hiçbir denetim onu veritabanında aşamadı. Bunun dışında bir sızıntı bulundu (sohbet geçmişi, Temmuz) ve düzeltildi. SQL'i ben yazmadım. Modeli tasarladım: hata modlarını, etki alanını; ve sistem dayanana kadar yapımını yönettim.

Prompt yapıştırıcısı değil, yönetişimli yapay zekâ tasarlıyorum

Yönetişim altındaki ajan döngüsü, algıla → bilgi → araçlar → değerlendir → ölç, korkuluklar, bir kriz protokolü, eksiye düşmeyen ölçümleme ve insan onayı kapılarıyla birlikte benim tasarımım. Kontrol düzlemi düşüncesi bana ait, kodu yapay zekâ benim spesifikasyonuma göre yazdı.

Yapay zekâyı yönlendirerek fikirden üretime

Altyapı, kodsuz bir Studio, özel üretken sanat, canlı bir Telegram kanalı (WhatsApp geliştirildi, Meta onayı bekleniyor), ölçümleme, kimlik doğrulama, özel alan adları. Hepsi benim fikrim, hepsi yapay zekayı yönlendirerek inşa edildi, Postgres'ten piksellere, yayında ve çalışıyor, tek başıma.

Makineye işini kanıtlatıyorum

Her değişiklik CI'da uygulanan bir saflık sınırını, son CI çalıştırmasındaki sayıda testi ve her bulgunun sayılmadan önce çürütüldüğü tekrarlanan düşmanca denetimleri geçmek zorunda. Yapay zekayı iyi yönlendirmek ona güvenmeyi reddetmek demektir, asıl beceri bu.

Yalnızca çıktı değil, muhakeme

Dürüst sürümü yayınlıyorum: denetim sayfasındaki her sayının kendi dipnot yıldızı var, site henüz neyin çözülmediğini açıkça söylüyor ve güvenlik: bir kriz mesajı sıfır kredide bile yardıma ulaşır, metriğin önüne geçer. Etkileyici olmaktansa güvenilir olmayı tercih ederim.

Garantileri bozmadan hızlı ilerliyorum

Her yeni yetenek aynı değişmezleri korur: bir golden-file test düzeneği değişikliklerin bayt düzeyinde güvenli olduğunu kanıtlar, bir düzenleme defteri her değişikliği geri alınabilir kılar ve yeni yüzey ekleyen her şey dağıtımdan önce saldırgan bakış açılı bir güvenlik incelemesinden geçer. Makinenin kestirme yol almasına izin vermeden hızlı ilerliyorum.

yöntem

Nasıl inşa ediyorum: dürüst versiyon.

Sistemin neyi garanti etmesi gerektiğine ben karar veriyorum, sonra bunu kanıtlamasını sağlıyorum. Sistemi tasarlıyorum ve inşa etmesi için yapay zekâyı yönlendiriyorum; PANTHEON bunun sonucu. Makinenin ürettiği her şeyi okuyorum, değerlendiriyorum ve hatalarını ayıklıyorum; uygulamayı boş bir dosyadan kendim yazmıyorum. Genel yapısı şöyle:

Ne yapıyorum

Sistemi ilk ilkelerden tasarla → yapay zekânın inşa edebileceği parçalara böl → her birini inşa etmesi için yapay zekâyı yönlendir → sonuç dayanana kadar ona saldır → yayına al ve üretimde çalışır halde tut. Uçtan uca döngü bu.

Ezbere bildiğim kavramlar

Çok kiracılı izolasyon & güven sınırları · yönetişim katmanları & döngüde insan · atomik ölçümleme & hız denetimi · ajan döngüleri, araçlar & korkuluklar · prompt injection savunması · hata modu & etki alanı düşüncesi. Bunların hepsini ben tasarladım. Sadece jargonla değil, sade bir dille anlatıyorum.

Yayına aldığım (ve uçtan uca anladığım) sistemler

Satır düzeyi güvenlikli Postgres · FastAPI servisleri · yönetişimli bir ajan döngüsü · her iki yönde MCP · React ön yüzleri · Docker / nginx dağıtımları. İnşayı ben yönettim ve her parçanın nasıl davrandığını biliyorum.

Yapay zekâyı nasıl dürüst tutuyorum

CI saflık sınırları · golden-file snapshot testleri · son CI çalıştırmasındaki sayıda test geçiyor (son CI çalıştırması) · tekrarlanan düşmanca denetimler: en sonuncusu 50 ajanlı bir denetim ve 14 mercekli bir yeniden denetim; her bulgu sayılmadan önce çürütülüyor. Makinenin ilk cevabına güvenmeme içgüdüsü işin ta kendisi.

Kanıtlar, dipnot işareti baştan eklenmiş halde.

Gerçek olmayan parçalardan etkilenmenizdense gerçek olan parçalara güvenmenizi tercih ederim.

1akıl, ekip yok* tek başıma tasarlandı ve yönetildi
CItest geçiyor* son CI çalıştırması, resmi bir kanıt değil
6 → 0denetimler · açıkta sıfır kritik bulgu* kendim çalıştırdım, üçüncü taraf değil
canlıüretimde, gerçek kiracılar* tek instance. Henüz ölçeklemem gerekmedi
2 → 1işletme, tek omurga* demo değil, platform, lint ile kanıtlandı

yanlış verdiğim bir karar

Kendi hatam da dahil, bir örnek.

İki hafta önce, çoğu mesajı ek bir yapay zekâ çağrısından kurtarmak için İngilizce mesajlardaki kriz ifadelerini yalnızca sabit bir ifade listesiyle kontrol etmeye karar verdim. 25 Eylül'deki bir denetim, listenin "I don't want to live anymore" ifadesini ve yaygın üç başka ifadeyi kaçırdığını gösterdi. Kararımı aynı gün geri aldım: kriz ifadeleri artık yapay zekâ kontrolüne gidiyor, dördü de eski kodda başarısız olan testler haline geldi ve ek çağrının maliyetini ödeyen sıradan mesajlar 32'de 4'ten 1'e düştü. Tasarruf çoğu kontrol için doğruydu, ama bir kaçırmanın en çok önem taşıdığı kontrol için yanlıştı.

dürüst anlaşma

Ne alıyorsunuz, ne almıyorsunuz.

Mimar + yönetmen

Sistem düşüncesini ve yapay zekâ aracılığıyla teslimatı ben üstlenirim: neyin yapılacağına karar vermek, nasıl ayakta kalacağını tasarlamak ve yayına çıkana kadar zorlamak. Benim sahip olmadığım satır düzeyindeki ustalığa sahip mühendislerle beni eşleştirin, iki yarıyı da kapsamış olursunuz.

Yapay zekânın kendi başına sahip olmadığı disiplin

Önemli olan her değişiklik çekişmeli incelemeden geçer; makinenin ilk cevabına asla güvenmem. Bu içgüdünün ortaya çıkardığı iki şey: kendi denetimimde bulunan ve artık bir regresyon testi olan Temmuz'daki kiracılar arası sızıntı ve başka birinin kodunda bulunan yukarıdaki MCP SDK güvenlik bildirimi.

talep

Aradığım şey.

Tek bir rol: yapay zekâ ajanınızın güven sınırını sahiplenen kişi. Çok kiracılılık, onaylar, ölçümleme, çağıranına güvenen araç: nerede başarısız olabileceğini belirlerim, garantiyi sistemin içine yerleştiririm ve bunu kanıtlayan testi teslim ederim. Gerçek müşterilere dokunan ya da dokunmak üzere olan bir ajanı bulunan bir startup'ta kurucu ekipten ya da erken dönem bir işe alım. Doğru fırsat için dünyanın her yerine taşınmaya açığım ve unvandan çok probleme ve insanlara önem veririm.

Neden kendi girişimim değil de bir iş?

Haklı bir soru. PANTHEON için yatırım toplayabilirdim, ama neyinin eksik olduğunu tam olarak biliyorum ve bu geliştirme değil. Eksik olan dağıtım: onu hedeflediği işletmelerin önüne koyacak ağ ve erişim. Bu bende yok ve varmış gibi yapmayacağım. Bunu, olmadığım bir kurucuya dönüşmek için yıllar harcamak yerine zaten o erişime sahip bir ekibe getirmeyi tercih ederim. Onu tek başıma inşa etmek, her şeyi tasarlayıp yayına alabildiğimi kanıtladı. Pazara tek başıma çıkarmak hiçbir zaman plan değildi. PANTHEON, odağımı bölen bir yan proje olarak değil, bir kanıt olarak canlı kalıyor.

ilk gün

Bana bir problem gösterin, ilk olarak ne yapacağımı anlatayım.

"Bir çeyrek boyunca işi öğren" değil. PANTHEON'u inşa eden yöntem, sizin ürününüze yöneltilmiş hâliyle:

Güven sınırını haritala

Kiracılık / yetkilendirme / etki alanı sınırlarını bulun ve her birinin nasıl başarısız olduğunu, herhangi bir şey inşa edilmeden önce çıkarın. Çizmediğiniz şeyi yönetemezsiniz ve onu çizmek benim işim.

Güvenliğin sonradan eklendiği yeri bulun

Sonradan eklenmiş güvenliği bulun: eksi bakiyeye düşebilen sayaç, kapısız eylem, çağıranına güvenen araç. Sonra bunu, garanti sonradan takılmış değil yerleşik olacak şekilde yeniden tasarlayın.

İnşayı yönlendirin, sonra kanıtlayın

Spesifikasyonunu yazın, yapay zekâya inşa ettirin ve onu kanıtlayan kontrolle birlikte yayınlayın: bir test, bir snapshot, bir değişmez (invariant). Böylece sonraki kişi her şeyi baştan kanıtlamak zorunda kalmadan hızlı ilerleyebilir.

Konuşalım.

Bana rolü ve ne inşa ettiğinizi anlatın. Her e-postayı okur ve birkaç gün içinde yanıtlarım; ardından bir görüşme, sistemin canlı bir tanıtımı ve NDA kapsamında kod incelemesi gelir.

Yazmadan önce kurcalamayı mı tercih edersiniz? Asistanı kırın, izolasyona saldırın ya da bota mesaj atın, hepsi canlı.

LinkedIn yok. Çekirdek sistem özel: canlı sistem portfolyonun kendisi, ancak altı bileşen PyPI ve npm üzerinde yayımlandı, hata kaydı herkese açık, yöntem yeniden oynatılabilir ve yüksek önem dereceli bir MCP SDK güvenlik bildirimi üzerinde adı geçen yedi raporlayıcıdan biriyim. CV'mi görüntüle / indir →