codex, めっちゃ細切れにタスク完了を報告してきてストレスだなぁ、って思ったけど、それなら/goalを使うのが本筋なんだな。 というか、これあれかな、/goal向けの調整をしている感じなんだろうな マジで/goalが前提だ
会話
関連する投稿
- author @BD1pt0ZCnY
9/4/2026, 9:29:59 AM musesparkを実際に使ってみていたが、かなり気に食わないのでパージ 怠惰さというか、切れ味がないナマクラのくせにすぐに諦める いやプログラマとしては切り分けは大事だし、トークン浪費するより良い気はするのだけども でもlunaにした瞬間ちゃんとコードを追って修正をしてくれたので、そっちのほうが印象が良い まーでもあれか? とっととイテレーション回すほうが効率良い気もするか
- author @BD1pt0ZCnY
9/3/2026, 9:02:07 PM 考えてみたけど、これ自体は既知だしそこまで意外性もないというか、普通に前はこの性質は応用していたな いつからこれを忘れていた/気にしなくなっていたんだ? わざわざ迎合を避けるムーブをせずともある程度妥当な意見を出すようになったっていうところと、エージェンティックな用途では迎合を避けるためにセッションを分離して嘘をついたり、自分のやりたいこととは反対のことを言うと致命傷を受ける可能性があるからかも なんかcodexとかにどっぷり浸かってから、あんまりわざわざLLMに嘘をついたり、こちらの立場を勘違いさせてみたり、みたいなムーブを取る機会が激減したんだよな そんなことを自分のPC上でやったら場合によってはとんでもないことになる可能性があるので とはいえ、たまにやることはないでもないか? 何らか監査をしたい時とか? でも結局ファイルを全部見せたりしていたら嘘つけないからな んー、あと意外性があるのはどちらかというと自分自身にもそういう性質があるよね、っていうのと結びついたところか?
- author @BD1pt0ZCnY
9/2/2026, 6:29:40 PM んー、ChatGPT(あるいはLLM)は言語感覚がやっぱり歪というか人間(あるいは俺)と異なっていて、ひらめきにセンスがない 言葉遊びとか洒落を上手く見いだせないんだよな 言葉を使ったなぞなぞが下手、という感じもある それが原因かわからんが、人文系全般にセンスを感じない いや知識をまとめさせればいい線いくんだけど、発想の飛躍/異種知との接着が下手 アライメントの問題もありそうだし、RLの問題もありそうだし、claudeとかはヌルッとユーザーに合わせそうなので調整/調教全般の差かもしれんが
- author @BD1pt0ZCnY
7/11/2026, 3:39:02 PM うみゃみー うみみゃあ Twitterで誰か一人くらい言っているだろって思ったけど誰も言っていなかった
- author @BD1pt0ZCnY
6/25/2026, 11:09:51 PM なんかcodexやばいな? こちらのターンを見失っちゃう ハーネスぶっ壊したのか?