カテゴリ /
AI
13件の記事
Auto-Tune Your LLM Judge
Measure the evaluator's variance, then rebuild its prompt from zero.

ExploitHunter.app の発表
スコープ、承認、ツール、証跡を1つのプロジェクトで一元管理するオープンソースのセキュリティ作業台。

モデルルーターを恐れるな
自信を持って最適なモデルへ

闇を評価で討ち滅ぼせ!
ベンチマークはベンチマークを測る。あなたのシステムには独自の指標が必要だ。

LLM接続文字列の時代が来た
llm:// URLでモデルとプロバイダー設定をシンプルに

LLMに数学をさせるのはやめよう
彼らは下手です。解決策はこちら。

不安定なエージェント構築はやめよう:ワークフローとメモリを使え
非決定論的モデルの決定論的パターン

これなしではAIエージェントは無価値
MCPがAIのUSB-Cである理由

本番AIは恐ろしい(そしてその修正方法)
ガードレールのないエージェントは、本番環境の準備ができていません。

モデルと結婚するな
LLMルーティング、今アツい

最後に考える者
人間か、機械か?

自分をAIに置き換える
GPTを心配せずに好きになる方法

AIが故障するとき&衝突するロボットカーたち
Googleの自動運転車は人間ドライバーの2倍の事故を起こしている
