Вся игра для ИИ — это формулировка идеального государства

Вся игра для ИИ — это формулировка идеального государства


Человек показывает ИИ точную структуру, которую он себе представляет, и ИИ ее строит.

Я говорю это уже около восьми месяцев, с разными подходами и уровнями громкости, но пока никто не обращает на это внимания.

Это либо потому, что я пришел слишком рано, либо моя идея не на треть так хороша, как я думаю. 😃

Но вот еще раз:

Думаю, скоро мы поймем, что вся игра для ИИ — это артикуляция идеального состояния.

И что все наши разговоры о спецификациях, планах, циклах, PRD и многих других вещах, о которых говорилось в разработке программного обеспечения и аппаратных средствах за последние шесть месяцев… все сходятся на одной и той же идее.

Я думаю, что это будет сформулировано в виде единого артефакта, который фиксирует, улучшает, повторяет, приближается, строит и тестирует идеальное состояние.

Один документ, который заменяет все эти циклы, спецификации, PRD, файлы планов, файлы дизайна и так далее.

Моя текущая реализация — это идеальная система артикуляции состояний (ISA).

Он превращает быстрое проектирование в целенаправленное проектирование в том смысле, что оно отказывается от указания ИИ, как что-то делать, и заменяет это сообщением, каким именно вы хотите видеть результат.

Это по-прежнему технически быстрое проектирование, но мы формулируем не КАК что-то следует делать, а, скорее, ЧТО следует делать. От оперативного проектирования к целенаправленному проектированию

У @karpathy был недавний пост, в котором вы говорили о прогулке и просто свободно высказывали идеи, связанные с тем, чего вы пытаетесь достичь. для меня это на 100% верно и на 100% является частью идеального состояния.

У нас также был недавний открытый взлом ИИ, в котором была поставлена ​​цель и предположительно она была достигнута. Похож на максимайзер для скрепок.

И в обоих случаях проблема в том, что мы передали цель, не передав идеальное состояние. Что, если бы оно было правильно сформулировано, включало бы множество скрепок, но человечество все еще существует или получает высшую оценку на тесте, но без создания новых эксплойтов и хакерских компаний.

Проблема всегда в догадках. Это разрыв между заявленным и неявным. Или заявлено и трудно сформулировать.

Вот почему я рассматриваю всю игру как выражение того, чего мы хотим.

Именно таким всегда был оперативный инжиниринг. Но с более ранними моделями, которые были не очень умными, возникла путаница, поэтому нам пришлось объединить целенаправленную разработку с пошаговыми инструкциями.

Я думаю, пришло время прорваться через это и изолировать эту центральную идею.

Огромное количество наших проблем, действительно во всем, но особенно при работе с другими и создании вещей с помощью ИИ, связано с предположением, что у получателя в голове та же идея, что и у нас.

И именно поэтому я предлагаю такой подход для непосредственного решения этой проблемы.

Давайте научимся хорошо формулировать идеальное состояние того, о чем мы просили. Это не только помогает принимающей системе построить то, что мы на самом деле хотим, с гораздо меньшим разрывом между нашим разумом и ее разумом, но после того, как она построена, она также становится инструментом тестирования, а также сердцем документации.

Это единая система для общего восхождения на гору, к чему угодно.

Как это выглядит на практике

Люди спрашивают меня, как это на самом деле выглядит, поэтому вот несколько реальных примеров из моих собственных систем. Surface, Human 3.0 и Experiments in Fiction — это живые продукты, и каждый из них имеет один файл ISA, расположенный в корне его репозитория. Этот файл одновременно является спецификацией, текущим состоянием и набором тестов.

Вот верхняя часть Surface ISA. Он начинается с цели, изложенной моими словами, и с подсчетом того, сколько утверждений об идеальном государстве было подтверждено.

Заголовок Surface ISA, показывающий цель, этап и 123 из 147 заявок, закрытых.

поверхность такова: 123 из 147 исков закрыты, а цель записана дословно вверху

Весь документ состоит из подобных утверждений. Каждое из них представляет собой конкретное, проверяемое утверждение об идеальном государстве, и каждое имеет определенный статус. Это функция RSS Surface.

Критерии Surface RSS с табличками состояния ВЫПОЛНЕНО

реальные критерии из RSS-раздела поверхности, каждый из которых можно закрыть с помощью зонда

Критерии поставляются с зондами. В каждом утверждении указывается точная команда, которая доказывает его ложность, а это означает, что спецификация ЯВЛЯЕТСЯ набором тестов. Вот таблица стратегии тестирования из Human 3.0 ISA.

Таблица стратегий тестирования Human 3.0 с датчиками скручивания и удара

стратегия тестирования h3: каждое утверждение называет тест curl или bash, который его проверяет

Когда я прошу свой ИИ добавить функцию, он сначала добавляет утверждения. Это из функции индивидуальных курсов, которую мы только что добавили на human3.ai. Мое дословное намерение зафиксировано вверху, взято из стенограммы голоса, а утверждения внизу кодируют то, что означает «сделано», включая те, которые все еще остаются открытыми.

Заявления об отдельных курсах Human 3.0 с дословным устным намерением

претензии к отдельным курсам h3, мои озвученные намерения указаны вверху

Затем система тестирования непрерывно запускает эти зонды. Это Bunker, наше приложение. Он считывает ISA каждого приложения и запускает все проверки в рамках своей стратегии тестирования. У Surface 24 из 26 баллов, и эти две ошибки — реальные проблемы, которые необходимо исправить.

Бункер запускает зонды Surface ISA с успешными и неудачными строками

бункер, в котором работают зонды на поверхности: спецификация — это буквально набор тестов

Каждое развернутое приложение находится в одной и той же системе, каждое из которых тестируется на своей собственной ISA по расписанию.

Панель управления Bunker, показывающая отсеки приложений и результаты тестов.

панель управления бункером: 26 приложений, каждое из которых проверено на соответствие своей системе

А поскольку артефакт структурирован, он визуализируется. Каждая ISA в системе получает HTML-версию, созданную на основе детерминированного шаблона, поэтому я могу читать состояние любого проекта, как документа, вместо прокрутки уценки. Вот сайт «Эксперименты в художественной литературе», сайт, который мы выпустили на этой неделе, все еще находится в стадии разработки. Весь этот блок ворот наверху был взят прямо из стенограммы голоса.

The Experiments in Fiction ISA находится в середине пути: 13 из 16 исков закрыты

Эксперименты в художественной литературе: 13 из 16 исков закрыты, но их количество продолжает расти

Документация о том, как все это работает, общедоступна:



Source link

Postagens Similares

  • मंटन रीस – ओपन सोर्स बनाम ओपन प्लेटफॉर्म

    डैनियल सुपरनॉल्ट ने सप्ताहांत में लूप्स को बढ़ावा देने के लिए पोस्ट की एक श्रृंखला बनाई थी, उनका टिकटॉक-प्रेरित ऐप शॉर्ट-फॉर्म वीडियो पर केंद्रित था, लेकिन खुला स्रोत और फ़ेडिवर्स से कनेक्ट था। यह एक वाक्य मेरे लिए विशेष था: यदि यह खुला स्रोत नहीं है, तो आप उपयोगकर्ता नहीं हैं, आप बेचा जा रहा…

  • Yerel ve Bulut | Kev Quirk

    📅 27 Kasım 2025 | ⏱️ ~3 dakika okuma Bu sabah işe giderken Waveform podcast’ini dinliyordum ve bulut ve yerel bilişim hakkında konuşuyorlardı ve benim de düşüncelerim var… Bu sabah işe gidip gelirken bulut ve yerel bilgi işlem hakkında konuşmaya başladıklarında Waveform podcast’ini dinliyordum. Tartışma hızla sınırsız depolama ve bir dünyayı veya diğerini seçmeyle ilgili…

  • 苦い錠剤のエンジニアリング |ダニエル・ミースラー

    私の AI エンジニアリングの随所で使用している、Bitter-Pilled Engineering (BPE) と呼ばれる新しい概念があります。 このアイデアは、リチャード・サットンのエッセイ「The Bitter Lesson」から来ています。 とりあえず、私のまとめです。 このエッセイでは、AI を制御、修正、強化しようとする人間の試みはすべて、ある種の価値がないと主張しています。なぜなら、より多くのハードウェアやより優れたアルゴリズムなどを通じて AI の知能を高めると、それ 人間のアプローチでできることよりもはるかに知性を向上させます。 私たち人間が AI には決して持たない魔法を持っていると考えるのはとても魅惑的ですが、その魔法は多くの場合単なる傲慢です。 実際にはそれよりも強いです。それだけでなく、 もっと良くならない 私たちが助けようとしても、おそらくそうなるでしょう はるかに悪い。 本質的に、実際には優れているわけではないため、優れていると思われるガイダンスによって AI のネイティブ機能を汚染することは避けるべきです。 エッセイからのいくつかの引用: 「70 年にわたる AI 研究から読み取れる最大の教訓は、コンピューティングを利用する一般的な手法が最終的には最も効果的であり、それを大幅に上回るということです。」 「私たちが望んでいるのは、私たちが発見したものを含む AI エージェントではなく、私たちと同じように発見できる AI エージェントです。」 「この恣意的な複雑さを見つけて捕捉できるメタメソッドのみを組み込む必要があります。」 「発見を組み込むと、発見プロセスがどのように行われるかを理解することが難しくなるだけです。」 私の要点: 論理、知性、効率についての私たちの考え方はおそらく原始的です したがって、AI に物事を「教える」方法にこれらのルールやアイデアをハードコーディングすべきではありません。 AI が賢くなるにつれて、第一原理に基づいて同じことを行うためのより良い方法が考え出されます。 残念ながら、私はその逆をする傾向が非常に強いので、この BPE の概念で自分自身をたたきつけなければなりません。 したがって、AI システムを構築するときの私自身の BPE ルールは次のとおりです。 自分の得意なアイデアや「賢い」アイデアをシステムに組み込んで、足場を過度に設計しないでください。代わりに、構築する足場が、より賢くなる基礎となる AI に対して堅牢で脆弱でないことを確認してください。 Source link

  • Fasulye Makinesi Retrospektif, bölüm 9

    C#, F#, Scala ve benzerlerinden farklı olarak yerleşik herhangi bir kalıp eşleştirmesi olmayan bir dil olan Python’da kısa “örüntü eşleştirme” uygulamak istedim. Mantıksal olarak bir kalıp sadece bir yüklemdir: bir değer alan ve değer kalıpla “eşleşiyorsa” true, aksi takdirde false değerini döndüren bir işlev. Bu bölümün kodu burada. Bu işe başladığımda iki şeyin farkına vardım….

  • 日落 512kb 俱樂部 – Kev Quirk

    2026 年 3 月 7 日 所有美好的事情都必須結束,今天就是我的專案之一「512kb 俱樂部」的日子。 我早在 2020 年 11 月就開始了 51​​2kb 俱樂部,到現在已經有大約 5.5 年了。它已經成為一個排水溝,我準備繼續前進。從今天開始,我將不再接受對該專案的任何新提交。在撰寫本文時,有 25 個 PR 可供新提交,我將處理它們,然後停用提交拉取請求的功能。 多年來,已有近 2,000 個拉取請求,目前 512kb 俱樂部上列出了約 950 個站點。很酷,但需要管理的工作量很大 – 需要審查新提交的內容(這是源源不斷的拉取請求)、清理舊網站、更新網站等。這超出了我的時間。 我還嘗試將時間集中在其他項目上,例如 Pure Commons。 想接手嗎? 看到這樣的計畫半途而廢令人難過,但生活還是要繼續。話雖如此,如果你覺得你想接手512kb俱樂部,我們來聊聊吧, 但有一些先決條件: 我們需要互相了解。抱歉,我不會把這個專案交給我不認識的人。 您可能需要熟悉 Jekyll 和 Git。 我可能會收到很多電子郵件,其中包含提供幫助的資訊(這太棒了),但如果我們以前從未互動過,我就不會繼續接受您的善意提議。 閱讀上述內容後,如果我們彼此認識,並且您仍然感興趣,請使用下面的電子郵件按鈕,我們可以就您可能接手的事宜進行討論。透過接手,我希望你能夠: 取得所有權 512kb.club 域,因此您將承擔續約的財務責任。 擁有 GitHub 儲存庫的所有權,因此您將負責所有拉取請求、問題和任何其他與 Git 相關的事情。 負責專案的所有託管和維護 – 該網站目前託管在我的個人 Vercel…

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *