分类 /
AI
找到 13 篇文章
Auto-Tune Your LLM Judge
Measure the evaluator's variance, then rebuild its prompt from zero.

宣布推出 ExploitHunter.app
一个开源安全工作台,将范围、审批、工具和证据统一归档到一个项目中。

别怕模型路由器
自信地定位最佳模型

评估制恶!
基准测试衡量基准。你的系统需要自己的度量。

是时候使用 llm:// 连接字符串了
简化模型与提供者配置,使用 llm:// URL

别再让大模型做数学了
他们做得不好。下面是解决办法。

停止构建脆弱代理:使用工作流和记忆
非确定性模型的确定性模式。

没有它,你的 AI 代理毫无用处
为什么 MCP 是人工智能领域的 USB-C。

生产级AI令人恐惧(及如何解决)
如果你的智能体没有护栏,就不适合投入生产。

别和你的模型“结婚”
LLM 路由,当下正火

最后的思考者
是人还是机器?

用AI取代自己
我是如何学会停止担忧并爱上GPT的。

AI失灵与撞毁的机器人汽车
谷歌自动驾驶汽车的事故数量是人工驾驶的两倍
