
LATEST ENTRY
文章を作るわけじゃない。Jevは何をするAIなのか
TypeSafe AIの判断モデルJevとは何か。LLMを分類や判断に使う際の課題から、Jevの型付き出力、並列評価、RLCD、確率の校正、confidence、判断を保留する設計まで、図と具体例で仕組みと基礎理論を考える。
記事を読むWEBLOG / PERSONAL ARCHIVE
写真、山、ソフトウェア、日々のメモを記録しています。
タグから探す
LATEST ENTRY
TypeSafe AIの判断モデルJevとは何か。LLMを分類や判断に使う際の課題から、Jevの型付き出力、並列評価、RLCD、確率の校正、confidence、判断を保留する設計まで、図と具体例で仕組みと基礎理論を考える。
記事を読むALL ENTRIES
193 postsGoの関数行数と明示的な純粋性制約を検査するmikotoを作った。値型の境界、ASTと型情報、ジェネリクスの型集合、暗黙のポインタ参照を扱い、5件の不具合修正と検証結果から静的検査の有効範囲と限界を考える。
OmoikaneのWPTで起きたSIGSEGVを調べると、Rust製JavaScript EngineのBoaのgetterが返した新しいオブジェクトが、VMレジスタへ入る前のinline cache更新で回収されていた。JITの切り分け、Valgrindでの確認、root修正と回帰テストを追う。
OmoikaneでJavaScript Realmを作るたび、約1.1MBのDOM bootstrapを解析・コンパイルしていた。キャッシュ案からRust製JavaScript EngineのBoaのscope検索と字句解析の改善へ方針を変えた経緯と、test profileでの実測を記録する。
AIを使った開発で作業量が増える一方、Rust製OmoikaneのCIはPRごとに長い待ち時間があった。文書変更の判定、Rustキャッシュ、WPT準備、連続pushを実測に基づいて見直した記録。
AIエージェントが問題を解き続けるだけでなく、今回作りたいものの完成へ収束するには。E2Eテストを受け入れ条件として先に置く開発方法を考える。
2018年に作ったGoの電話番号判定ライブラリgo-tel-num-parser-jpを更新した。060や0200などの番号区分に加え、部分一致による誤判定も修正した。
URLの#fragmentがどの要素を指し、CSSの:targetやquerySelectorの結果へどう反映されるのか。HTMLとSelectorsの仕様を手掛かりに、Omoikaneの実装とテストを追う。
検索、分類、判断を何でもLLMに任せるべきか。キーワード検索やBM25、Embedding model、判断モデルJev、LLMの役割を、具体例を通して整理する。