2026年08月20日
- kojima295
- 8月20日
- 読了時間: 2分
更新日:8月20日
おはようございます。
・・・
ChatGPTさんですが、、、本日19:02に使用量リセットがかかります。
リセットされ次第、例のプロジェクトを再開致します。
・・・
先日、お話をしたとおり、、、LLMを使用せずとも画像処理の延長上でLLMに匹敵するモノを作成可能です。
拡張モデル
研究セットとして、、、
PhaseBench v0.1
A. ProofWriter
10,000問
B. SCAN
compositional split
C. COGS
generalization split
D. CLUTRR
reasoning depth 2~6
E. 独自 Japanese ProofWriter
10,000問
評価:
・Semantic parse accuracy
・Fact retrieval accuracy
・Reasoning accuracy
・Proof accuracy
・Unknown rejection precision
・Unknown rejection recall
・Compositional generalization
・memory bytes / fact
・latency
・energy / query
上記を用いて、ChatGPTさんに、
ProofWriter / RuleTakerの論理生成器を利用した日本語版を作成するようお願いをしました。
ChatGPTさんの目測によると・・・
============================================
例えば同じ論理を、
bird(penguin)bird(x) → animal(x)
animal(x) → breathe(x)
として固定して、
日本語だけを変えます。
ペンギンは鳥です。鳥は動物です。
動物は呼吸します。
さらに、
ペンギンは鳥の一種です。鳥類は動物に分類されます。
動物には呼吸能力があります。
など複数表現を用意する。
すると、
Formal Logic
│
┌──┴──┐
↓ ↓
English Japanese
│ │
└ ─┬─ ─┘
↓
Phase Language
Machine
という非常に強力な実験ができます。
しかも正解は自然言語ではなく、
TRUEFALSE
UNKNOWN
+
proof graph
なので、評価が完全に機械化できます。
==============================================
と考えたようです。。。
・・・
キタ~~~!!
さすが、東大首席以上の能力!
おっ、、、どうした!!
回線が切断されたぞ!!
・・・
あのですね、、、皆さん・・・
AI がなんだかんだ言って、、、
女性の新人さんは、、、プログラマーを目指すと良いよ!と考えております。
幸せになれるかもしれません。。。
・・・
う~~ん、、、
これは、のほほ~~んと暮らしているわけにはいきません。
覚悟を決めて・・・
まあねえ、、、100円あれば・・・
マジでかなりのことができます!
「そんなもの、オモチャだろう!」という人もいるだろうけど、、、
オモチャも本物も、仕組みは同じですよ。。。
・・・
今、私の考えを、首席たち(ChatGPTさんとClaudeさん)に纏めてもらっています。
(私の考えとは言え、多くは首席たちの力によるものです。。。)
内容としては「未知の日本語には対応できない!」というものとなりました・・・
当たり前と言えば、あたりまえのお話なのですが。。。
大規模なデータセットがどうしても必要となります。
しかし、この結果作り上げられるモデルは、驚くほどコンパクトになりそうです!
現在、改善を続けています。
本格的LLMに匹敵するシステムをつくることできるか!?

コメント