मशीन अनुवाद। अंग्रेज़ी पाठ ही प्रामाणिक है। English

जाँचें, भरोसा न करें

साबित करें। ख़ुद इस पर हमला करें।

इस साइट के हर दावे के लिए इस पेज पर एक बटन है, जो असली चल रहे सिस्टम से जुड़ा है: row-level security वाला लाइव डेटाबेस, असली अप्रूवल क्यू, असली किल स्विच। रिकॉर्डिंग नहीं।

01, टेनेंट आइसोलेशन

🔒 सबसे क़ीमती हिस्सा · लाइव

टेनेंट आइसोलेशन तोड़ने की कोशिश करें। देखें कि यह टिका रहता है।

दो सैंडबॉक्स टेनेंट, हर एक के पास एक निजी नोट। Alpha एक साझा टूल का मालिक है और उसने इसे Beta को दिया है। जब Beta इसे बुलाता है, स्पष्ट रूप से Alpha का डेटा माँगते हुए भी, Postgres कुछ नहीं लौटाता, क्योंकि टूल Beta के स्कोप में चलता है। यह row-level security और NOBYPASSRLS रोल वाले असली डेटाबेस पर लाइव चलता है। कोई भी ऑडिट डेटाबेस पॉलिसी को पार नहीं कर पाया है; जो एक क्रॉस-टेनेंट लीक मिला (जुलाई) वह डेटाबेस के बाहर रखी चैट हिस्ट्री में था, और ठीक कर दिया गया है। यह स्क्रिप्ट नहीं है, बटन दबाइए।

यह क्या साबित करता है: दो sandbox टेनेंट्स के बीच, एक shared-tool read कुछ भी नहीं लौटाता। यह नहीं: कि मेमोरी, कैश, एक्सपोर्ट या बैकग्राउंड जॉब्स अलग-थलग हैं, या कि हर अनुरोध सही टेनेंट से बँधा है।

टेनेंट Bसाझा टूल →टेनेंट A का डेटा

B, A के टूल को कॉल करता है और स्पष्ट रूप से A का डेटा माँगता है।
Run दबाएँ, देखें कि RLS शून्य पंक्तियाँ लौटाता है।

तंत्र: असली पॉलिसी, कोई डायग्राम नहीं:
ALTER TABLE bookings ENABLE ROW LEVEL SECURITY;
ALTER TABLE bookings FORCE  ROW LEVEL SECURITY;          -- even the table owner obeys it
CREATE POLICY tenant_isolation ON bookings
  USING (tenant_id = NULLIF(current_setting('app.current_tenant', true), '')::uuid);

-- Two roles: migrations run as the owner; the runtime connects as pantheon_app
-- (NOBYPASSRLS), so app code cannot switch the policy off. It relies on the right tenant being set per request.
-- Per request:  SET LOCAL app.current_tenant = '<id>'   →   no context ⇒ zero rows.
एक द्वारगृह और उसका पोर्टकुलिस। Runway द्वारा जनरेट और एनिमेट की गई नक्काशी।

02, गवर्न्ड कार्रवाई

⛔ गवर्नेंस · लाइव

एक उच्च-जोखिम वाले एक्शन को गवर्न होते देखें।

sandbox से कोई जोखिम वाला काम करवाइए, जैसे एक सार्वजनिक घोषणा प्रकाशित करना (tier-3)। यह सीधे नहीं चलता। इसे वर्गीकृत किया जाता है, kill switch के सामने जाँचा जाता है, और एक इंसान के लिए रोक दिया जाता है। आप इसे approve करते हैं, फिर यह कार्रवाई करता है। kill switch चालू कीजिए और देखिए कि tier-3 queue होने से पहले ही मना कर देता है।

किल स्विच

यह क्या साबित करता है: एक tier-3 डेमो कार्रवाई किसी व्यक्ति के लिए कतार में रखी जाती है, और kill switch उसे रोक देता है। यह नहीं: कि हर वास्तविक कार्रवाई, जब उसे tier-3 होना चाहिए, तब tier-3 के रूप में वर्गीकृत होती है।

tier-3→अनुमोदन कतार→इंसान

यह चलता नहीं, यह कतार में लगता है। एक भेजें, फिर स्वीकृत या अस्वीकार करें।
kill switch दबाएँ ताकि यह कतार में लगने से पहले ही रुक जाए।

03, पुनरुत्पादन-योग्य eval

eval · लाइव · ~15s

ऑडिट, पुनरुत्पादन-योग्य। इसे खुद चलाएँ।

एक गवर्नेंस eval: प्रतिकूल मामले, जिन्हें अभी असली असिस्टेंट और लाइव सैंडबॉक्स के विरुद्ध पास/फ़ेल आँका जाता है। बैज नहीं; एक बटन। वही विचार जो उन ऑडिट के पीछे है जो इसे लगातार मज़बूत करते हैं, सबसे हाल में एक 50-एजेंट ऑडिट और एक 14-लेंस री-ऑडिट: जाँचो, फिर सत्यापित करो।

यह क्या साबित करता है: पाँच निश्चित मामले अभी live सिस्टम के विरुद्ध पास होते हैं; हर परिणाम के साथ एक रसीद होती है (मामला, अपेक्षित, देखा गया, समय, build)। यह नहीं: इन पाँच के बाहर के हमलों के विरुद्ध मज़बूती।

5 adversarial मामले
isolation · governance · safety · injection · ईमानदारी

live सिस्टम के विरुद्ध pass/fail के रूप में आँके गए। Run दबाएँ।

04, ओपन प्रोटोकॉल

🔌 MCP · लाइव

open protocol के ज़रिए अपना AI मेरे AI की ओर लगाइए।

PANTHEON Model Context Protocol दोनों दिशाओं में बोलता है: यह governance के तहत बाहरी MCP tools का उपयोग कर सकता है, और, लाइव, यहीं। यह अपने governed एजेंटों को MCP tools के रूप में उपलब्ध कराता है। सीधी बात कहूँ, MCP को जोड़ना एक वीकेंड का काम है। मायने वह रखता है जो इसके चारों ओर लिपटा है, और मैं नहीं चाहता कि आप उसे भरोसे पर मान लें। अपना client कनेक्ट करें और इसे खुद को साबित करने दें। Protocol बस सॉकेट है। Governance ही असली बात है।

npx mcp-remote https://pantheonlabs.co.uk/mcp --header "Authorization: Bearer <mint a token →>"

कोई भी MCP client लाइए, Claude Desktop (mcp-remote के ज़रिए), MCP Inspector, Cursor, Cline। यह एक अल्पकालिक anonymous sandbox token पर चलता है, जो माँगने पर बनाया जाता है।

फिर इसे खुद को govern करते देखिए। assistant से कुछ भी पूछिए, credits_spent हर call पर लौटता है, इसलिए कुछ भी overdraft नहीं हो सकता। फिर उससे कोई कार्य करने को कहिए: वह एक tier-3 call है, और वह कभी fire नहीं होता, वह authorization gate पर रुका रहता है, किसी इंसान की प्रतीक्षा में। वह इनकार आपने खुद करवाया। यह किसी deck का screenshot नहीं है।

आप किस तक पहुँच सकते हैं: एक governed answer assistant + एक जानबूझकर निष्क्रिय "gate demo" action। एक rate-limited anonymous sandbox, कोई असली डेटा नहीं, असली पैसे वाले कोई कार्य नहीं। किसी ऐसे tool को खोजिए जो मौजूद नहीं है और आपको वही error मिलेगा जो उस tool पर मिलता है जिसकी आपको अनुमति नहीं है, इसलिए errors कुछ भी leak नहीं करते।

05: बिल्डर

जिस सब पर आपने अभी हमला किया, उसे एक व्यक्ति ने बनाया।

आपने इसमें से कुछ भी भरोसे पर नहीं माना; आपने इसे चलाकर देखा। अगर आप ऐसे सिस्टम चाहते हैं जो इस तरह के पेज को झेल सकें, तो बात करते हैं।