AI謎解きプロジェクト 第二問の正解状況

いやいや、びっくり、正解者がすぐに現れましたね。びっくりです。第二問はこちらでした。こんな状況になるとは。 各AIと、前に紹介したローカルLLMの回答状況です。

AI正解状況順番補足
ChatGPT5番目出題者自身
Gemini1つのみ
Grok×1つのみ 少しずれあり
Copilot×1つのみ 少しずれありGrokと同じ答えで誤答
ローカルLLM正解状況補足
qwen2.5:1.5b返答は出たが、回答はされず
qwen3:4b1つのみ思考時間389秒
qwen3.6×1つのみ 誤答
思考の途中で、正答も候補に挙がっていた
思考時間1597秒
gemma4:12b思考がループしている? 回答でず。 思考の途中では候補には出ていた、返答は出ず20分経過
思考時間2159秒?
llama3.2:1b回答だせず
llama3.2:3b×1つのみ 誤答
直接的な安直な回答
20秒程度

AIGemma、AIモデルLLMOllamaQwenオフラインAIローカルLLMローカル生成AI生成AI

gemma4:latest 確認対象から除外

この結果、特にローカルLLMの性能に驚きです、GrokやCopilotよりも qwen3:4bのほうが結果を出すとは。。。  

しかし、ChatGPTもqwen3:4bも似たような思考パターンで推測していました。なにか元となる小説なり何かあるのかなと推測しましたが、そうでもなさそうです。教育のもととなった文書が同じようなものを使っているので、同じ結果に買ったのかもしれませんね。 人間には違和感しかないが、AI同士では意気投合していると感じた結果でした。 

さあ、貴方も問題に挑戦して、ゴールにコメントを残していってください

関連記事

コメントを残す

メールアドレスが公開されることはありません。 が付いている欄は必須項目です