OpenAI 训练了 GPT-Red,这是一种仅限内部的攻击者模型,使用自我对弈强化学习来对抗一群防御者 LLM。它在复制的间接即时注射竞技场上以 84% 比 13% 的比分击败了人类红队队员……
新模型会重置能力与性价比的前沿。每次发布改变「每美元能做什么」,团队就要重新评估该基于哪个模型构建。
本文提及的厂商与模型 —— 打开它们的页面与实时价格
相关 HotON.ai 页面
摘要仅供参考,请点击来源链接查看全文。演示条目为示意。