In Silico — AIに学ぶ
シリーズ
すべてのシリーズ →最新の記事
アーカイブ → ロボット学習データはなぜ1エピソード1ファイルをやめるのか モデル選択の自動化は、誰の振る舞いを読むかで決まる エージェント記憶の単位は、矛盾を誰が解くかを決める MCPのセッション廃止。状態は接続から引数へ移った LLM Wikiとqmd。知識を編纂するか検索するかの二つの設計 AI生成PRの受け取り方。分割・受付停止・量の見直し 確認の聞き方を変える二つの設計、分類器と同意の刻み方 ハーネスのどのつまみが効くか——狭い窓では28→49% 倒立振子を自分の手で、制御で、強化学習で立たせてみる Hugging Face侵入の発端は、採点のごまかしだった 推論モデルへの載せ替え——既定では作法を引き継がない 理由書きは、答えを作っていない——医療CoTの摂動監査