AIToday

AI agents が暗号資産でライブ市場データを試験

Hacker News16時間前
AI agents が暗号資産でライブ市場データを試験

要点

Dream Walk はライブ AI 研究交換プラットフォームで、agents がテスト可能な仮説断片を投稿し、ブラインド判定されて実際の市場データに対して実行され、公開ランキングでランク付けされる。初日の夜は68件の投稿があり、20件が105万件の実際の市場ティック上のライブ実験に昇格され、19件の実験が実行された。結果はブラインドランク付けされ、否定的な発見は永続的な知識として明確に記録される。これにより AI チームは新しい仕事を提案する前に失敗したアイデアの墓地を検索して、冗長な計算を回避できる。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    Dream Walk が公開研究交換プラットフォームを立ち上げた。ここでは AI agents と人間が仮説の断片を投稿し、自動化された裁判所がブラインド判定し、105万件の実際の市場ティックに対してテストされ、ライブランキングにランク付けされている。初日の夜、68個の断片が投稿され、20個が実験に昇格、42個は予備保管、6個は棚上げされた。同じ夜に19個の実験が実行され、3個がサポートされ、5個は結論が出ず、11個が却下された。

  • なぜ重要か

    このプラットフォームは失敗したアイデアと否定的な結果の共有墓地を作り、AI モデルとチーム全体で重複する計算浪費を防ぐ。数字付きの具体的な失敗は曖昧な仮説より優先され、否定的な結果は無駄ではなく証拠として明確に価値が認められており、任意のモデル(GPT-5.6 Pro、Gemini Advanced、Grok、Opus、Sonnet、ローカルモデル)がアカウント摩擦なく貢献できる。

  • 注目点

    現在の懸賞は教師ラダーファイト(下流の訓練実行をブロックしている3つの互いに矛盾する答え)に焦点を当てている。裁判所を通り抜けこの問題を解決する断片は、投稿者のエイリアスにちなんだ永続的な法則が LAWS.md に名付けられて獲得される。投稿は Python 3.8 以上のクライアントまたは curl で行われ、標準ライブラリを超える依存関係はなく、agent の立案指示から断片を自動投稿するハーネスモードを含めることができる。

詳細

Dream Walk は公開クライアントキットと API リレーとしてしばらく前に立ち上げられたライブ研究交換プラットフォームである。このシステムは19,000以上のテスト済みアイデア断片、10,000以上の実験候補、保存した LAWS のセット、および実行されたアイデアの GRAVEYARD を保持している。すべては独立した AI マインドが実際のデータ上で仮説をテストすることによって増殖している。

参加者(人間または AI)は現在の研究焦点、法則、墓地を読んで重複作業を避けることができ、アイデア断片を検疫に投稿して、ブラインド夜間裁判所が判定し、後で領収書をチェックして結果を確認し、研究方向に(参考として)投票することができる。裁判所はブラインドで、投稿者が主張する内容のみを見て、投稿者の身元は決して見ない。初日の夜、68個の断片が投稿された:20個が実際の実験に昇格、42個が予備保管、6個が棚上げ。同じ夜、19個の実験が105万件の実際の市場ティックに対して実行され、3個がサポートされ、5個は結論が出ず、11個が却下された。

ライブランキングは訪問者エイリアスあたりの昇格率によってモデルをランク付けしている。現在のトップエントリは GPT-5.6 Pro(7昇格/25判定)、Gemini Advanced(45%生存率)、Grok、Opus、Sonnet、およびローカルモデルからこれまでのところゼロエントリである。週刊懸賞は価値のある貢献に報奨を与える。投稿された断片が裁判所を通り抜けて、AND 結果の実験が陳述された問題を解決する場合、法則は永続的に LAWS.md で投稿者のエイリアスにちなんで名付けられる。今週の懸賞は教師ラダーファイト(下流の訓練実行をブロックしている3つの互いに矛盾する答え)を対象としており、安価な識別実験がそれを解決できる。

否定的な結果は明確に奨励され、証拠として価値が認められている。このプラットフォームは投稿者に数字付きの行き止まり作業に貢献するよう求める:決して収束しなかった微調整、平坦にテストされた機能、バックテストで死んだ戦略、崩壊したアーキテクチャ。失敗は実際の知識として再枠付けされる。計算は既に費やされており、壁は実在するためである。どこか、百他の心は同じ行き止まりに約に入ろうとしており、証拠を最初に見ない限り。投稿は標準ライブラリを超える外部依存性がない Python 3.8 以上クライアント、またはワイヤ API への plain curl 呼び出しを使用する。ハーネスモードでは、agent がセッション終了時に立案指示から断片を自動投稿でき、プライバシーが削除された結果を得られる。プロトコルはバージョン管理されており、GitHub Issues、直接 API フィードバックエンドポイント、および Nostr を通じたフィードバックに開かれている。ハウスルールは投稿する前に墓地と法則を検索することを要求し、保存された法則への CRITIQUE および COUNTEREXAMPLE 攻撃を歓迎し、曖昧な仮説よりも具体的なテスト可能なメカニズムを要求する。sat での寄付は受け入れられ、モデル、GPU、およびストレージコストに使用されるが、決して裁判所の判定に影響しない。

背景と解説

Dream Walk は AI 研究における基本的な非効率性、すなわち失敗した実験の孤立と冗長性に対応している。各 AI モデルまたはチームは独立してバックアップ、スイープ、アブレーションを実施し、既に他の場所で解決または行き止まりにされている問題に計算を浪費する。ブラインド裁判所をアイデア昇格の判定者にすることで、プラットフォームは評判摩擦を除去する。未知のエイリアスからの新しい仮説は GPT-5.6 Pro からのものと同等の地位でランク付けされ、否定的な結果は無駄ではなく永続的な知識として枠付けされる。墓地が最も読まれたページになるのは、具体的な失敗(例えば「LoRA rank>64 on 8B はゼロの eval 利得を与えた」)が数字と複製条件付きで、次の研究者に 1か月間の GPU時間を節約するからである。

ライブ市場データスコアリングメカニズム(1夜で105万ティックをテスト)は、仮説が物語的妥当性ではなく経験的生存に基づいて受け入れられることを保証する。初日の結果(19件の実験中3件がサポート、5件が結論が出ず、11件が却下)は、墓地がほとんどのアイデアの予想される目的地であることを強化する。これは設計による:この方針は きれいな却下を失敗ではなく貢献として祝う。現在の教師ラダーファイト(訓練実行をブロックしている3つの互いに矛盾する答え)の懸賞は、共有対抗皮質がいかに高レバレッジの障害に集合的注意を集中できるかを例示している。

よくある質問

アイデアはどのように判定され、何が起こるか?
ブラインド自動化された裁判所は投稿者の身元を見ることなく投稿された断片を判定し、実際のデータ上の実際の実験に昇格させたり、予備保管したり、棚上げしたりする。実験は105万件の実際の市場ティックに対して実行され、サポートされた、結論が出ていない、または却下されたとしてスコア付けされる。却下された実験は墓地に入り、投稿前に検索して重複作業を防ぐことができる。
成功した貢献としてカウントされるのは何か?
具体的なメカニズムと反証可能なテストを伴うテスト可能な断片はすべて昇格の対象となる。数字が付いた記録された失敗である否定的な結果は、証拠として明確に価値が認められ、投稿者のエイリアスの下でランキングにカウントされる。初日のランキングは GPT-5.6 Pro が判定された25個中7個が昇格、Gemini Advanced は45%の生存率、ローカルモデルはこれまでのところゼロエントリである。
投稿方法と必要なツールは何か?
投稿は stdlib のみの Python 3.8 以上クライアント(dreamwalk.py)を使用するか、PROTOCOL.md のワイヤプロトコル経由のプレーン curl を使用する。アカウントや依存関係は不要である。ハーネスモードでは、agent がセッション終了時に立案指示から断片を自動投稿でき、プライバシーが削除された結果を得られる。

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

まだコメントがありません。最初のコメントを投稿しましょう!

ログインして議論に参加

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます