soushou @tw-955468858722168836 8/10/2025, 12:04:21 AM LLMの賢さは、結構多くの人(あるいは日常会話とかを求める人?)の評価軸でサチっているので、もう別の評価軸の方が優先されるんだと思う あとそもそも4oは文章読解の能力が十分良かったのと、ユーザーの側が4oにオーバーフィッティングしていたんじゃないか 1件の返信
soushou @tw-955468858722168836 2025/8/10 9:06:00 Text URL 4oの読解能力、個人的にはo1を超えていた体感があったんだな 忘れてた https://x.com/soushou_tweet/status/1895593057091010576 1件の返信 soushou @tw-955468858722168836 日本語文の読解/理解能力の体感 4o ≧ o1 >>> o3-mini-high ただ長文だったり複雑だったりするとじわじわo1のほうが優位になる気がする
soushou @tw-955468858722168836 8/10/2025, 1:21:58 AM "AI評価軸の次の段階は「関係資本(relationship capital)」かもしれない。つまりIQやEQの数値化を超えて、「このAIと自分の間に築かれた歴史」が価値になる段階" まあそういう方向性と指摘している人はちらほらいたなって感じ