
Unbounded Labsが1931年以前の英文で学習させた小型LLM「Bart」を公開した。
AIが過去の科学的知見を再発見できるかを探る試みだ。
モデルは現在、デモとオープンソースの重みとともに利用できる。
何が起きたか
Unbounded Labsは、1931年以前に書かれた英語の200億1000万トークン(20.1Bトークン)でゼロから学習させた、パラメータ数28億2000万(2.82B)のLLM「Bart」を発表した。学習には3か月と800ドル(800ドル)を費やした。現在はデモで試すことができ、記事とHugging Face上のモデルも公開されている。
なぜ重要か
Demis Hassabis氏の提案に触発されたBartは、LLMが過去の偉大な科学者のように結論に到達できるかを検証する試みだ。開発者らは、この分野の進展が「モデルが独自のアイデアを持つのか、それとも単に次のトークンを予測しているだけなのか」というAI研究の核心を突くものだと考えている。日本語のAI研究者は、過去の文献のみで学習したモデルの限界を検証する新たな事例を入手できる可能性がある。
注目点
記事では、コーパスの調達、クリーニング、既存のものが存在しなかったため新たに構築したベンチマーク、アブレーション、トレーニング実行、ポストトレーニング、そして失敗について詳述されている。読者はデモ、記事、Hugging FaceモデルにアクセスしてBartの能力を確認できる。
Unbounded Labsは、AIを歴史的知識に基づかせるという意図的な実験としてBartを開発した。学習データを1931年以前の英語に限定することで、LLMが過去の科学者と同様の結論を独自に導き出せるかを検証しようとしており、この問いはDemis Hassabis氏から着想を得たものだ。プロジェクトの費用はわずか3か月で800ドル(800ドル)であり、小規模な予算でもこうした研究が可能であることを示している。
チームは、ヴィンテージテキストで学習させたモデルを評価するためのベンチマークが存在しなかったため、新たに作成する必要があった。彼らの詳細な報告には、コーパスの調達、クリーニング、すべてのアブレーション、トレーニング実行、ポストトレーニングが含まれており、プロセスを透明に公開している。「創造できないものは、理解したとは言えない」という言葉は、既存モデルのファインチューニングではなく、ゼロから構築するという彼らの動機を強調している。
Bartの公開は、モデルが独自のアイデアを生み出せるのか、それとも単に次のトークンを予測しているだけなのかという根本的な問いに取り組む点で、AI研究にとって重要だ。一般相対性理論は予算外だったが、このプロジェクトは、ヴィンテージ領域の探求がAIの創造的可能性についての洞察をもたらす可能性を示唆している。記事とデモにより、誰でもこのアプローチと結果を直接確認できる。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
イスラエルの新興企業DataAgent Ltd.は、顧客のKubernetesクラスター内の本番障害を修復するプラットフォームを発表し、1000万ドルのプレシード資金を調達した
SK海力士はSEMICON Taiwan 2026で、ベースダイに演算機能を組み込んだカスタムHBMの構想を発表

エヌビディアの決算は注目に値する一方で退屈な内容となり、統合された世界を避ける姿勢が反映された

AnthropicがNvidia支援のクラウド事業者Lambdaと、$35bnのクラウドコンピューティング契約を結んだ

最高裁判所は2027年度予算案にAI関連費用として約6000万円を計上

消費者庁は24日、全国の消費生活センターに寄せられる年間約90万件の相談を生成AIで分析し、詐欺の手口や事業者の経営破綻の早期サインを検出すると発表した
