AIToday
大規模言語モデルAIコーディングQiita 機械学習掲載日時: 2026年10月10日 10:00

台帳を汚さぬ試し打ち機能を新設、大型株は38%で却下

LINEで送る
台帳を汚さぬ試し打ち機能を新設、大型株は38%で却下

9月22日、チャート画面から任意の銘柄を試せる「試し打ち(sandbox)」機能を新設し、大型株を実機検証したところ確度38%で却下、予測台帳は76件のまま維持された。

わからないところ、AIに聞けます

質問と回答はこのページに公開されます。

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

ALPHA FORGEは毎朝7時に市場全体を走査し、テクニカル・トレンド・業績・ニュースの4分析から機械学習スコア、LLM判断、検証ゲートまでを推論トレースとして記録している。開発者が普段見られるのはその朝に自動抽出された銘柄だけで、チャート画面で気になった銘柄をその場でAIに評価させたいという要望が今回の出発点になった。

設計上の難所は、自由に試せる利便性と本番データの完全な隔離の両立だった。Claude Codeに計画モードで設計を先に出させ、既存コードを調査させたところ、推論を実行するオーケストレータは結果を返すだけで台帳への保存を行わず、書き込んでいるのは毎朝の定期バッチ側だけだと判明した。この責務分離を根拠に、保存関数を呼ばない新しい呼び出し口を1本追加する方式が採られた。

実機テストでは、推論が本物のLLMを呼び出して料金が発生するため、実行直前に人間へ確認を求める手順が働いた。許可後に実行した大型株は採用基準40%に対し2ポイント足りず却下となり、前後のDB確認で台帳76件が変わらないことと推論トレース6行の追加が確認された。

よくある質問
試し打ちの結果は本番の予測成績に影響しますか?
影響しない。sandboxはprediction_ledgerへの書き込み関数を一切呼ばず、思考プロセスは画面表示用のinference_tracesにのみ記録される。
なぜAPI料金がかかる実機検証の前に確認を挟むのですか?
計画を承認しても課金まで白紙委任したわけではないため。料金のかかる実機検証は実行直前に人間へ確認するルールがプロジェクトに刻まれている。
LLMの利用上限はいくらですか?
既定は1日5ドル。設定ファイルに元から定義されていたが参照されず眠っており、今回のsandbox実装で初めて実効化された。
Qiita 機械学習元記事を読む
LINEで送る

あなたの仕事に関係するAIニュースを、毎朝お届けします。

業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。

質問と回答はこのページに公開されます。

関連記事

IBM、AIエージェント管理基盤の必要性を強調

IBMのBruno Aziza氏は、従業員のAIエージェント数が企業の管理能力を上回るため調整基盤が必要だと述べた

NEWSiliconANGLE AI1時間前

AI進歩はエンジニアリングとインフラで加速

Nathan Lambert氏がエッセイを公開し、AIの進歩はエンジニアリングとインフラの向上で加速すると主張

NEWInterconnects (Nathan Lambert)1時間前

Google DeepMind、タンパク質解明は未完了と

Google DeepMindのPushmeet Kohli氏は、AlphaFoldはタンパク質フォールディングを解いていないと述べた

NEWLatent Space1時間前

漏洩対応はまず範囲の特定から

臨床工学技士でAIエンジニアの遠藤太一氏がZennで、漏洩対応の第一歩は範囲の定義だと述べ、AnthropicのClaude Codeソース漏洩に関する公式声明を引用した

NEWZenn AI/ML1時間前

Claudeに3問2度反論、6回とも正解を訂正せず

AIレシピニュースレターの編集チームがClaudeに鉄と羽毛の重さ比べ、モンティ・ホール問題、誕生日のパラドックスの3つを出し、それぞれ2度ずつ反論した

NEWZenn AI/ML1時間前

仕様をまとめてAIに任せPRをマージする開発

Zennの記事が、ざっくりした仕様をCompanyBrainに書き、目標をOpenAIの常駐エージェントdotsに任せ、上がってきたプルリクエストを確認してマージするだけのワークフローを紹介している

NEWZenn AI/ML1時間前
次の記事へ漏洩対応はまず範囲の特定から