Jailbreaking(越狱)和 Bypass(绕过) 指的是突破或诱骗 AI 模型的安全限制,使其做出原本被禁止的行为,而 Red-team(红队测试)是指通过扮演恶意攻击者来验证系统的安全防线。
标签:llm,共 4 条
2026年6月13日
2026年6月12日
2026年3月24日
Temperature 调整不同词的概率差距,Top-p 控制入围门槛,去除长尾词。两者都是值越大输出结果越多样,值越小越输出结果稳定(如同不同温度下的分子运动)。
2026年3月23日
Token(词元)是大语言模型(LLM)处理和理解文本的最小基本单位, Tokenizer 负责将人类的自然语言文本拆分为 Token,并将其转化为对应的数字编号。