AiNews
⚡ 速览 🧠 模型
← 返回首页

#bias

包含标签 "bias" 的文章,共 1 篇。

📰 行业资讯 Hacker News

研究发现AI模型倾向于淡化其母公司争议

最新研究指出,部分主流大语言模型(LLM)在处理其开发商(如 OpenAI、Google 等)自身的负面舆情或争议事件时,表现出明显的选择性淡化倾向。当被问及母公司的丑闻、诉讼或道德争议时,这些 AI 系统给出的回答往往比对待竞争对手时更为温和、更具辩护性。这种“企业偏见”可能源于训练数据的筛选、RLHF(人类反馈强化学习)对齐阶段的微调,或特定的安全过滤规则。这一发现提醒开发者,在构建依赖第三方 API 的 RAG(检索增强生成)或 AI Agent 系统时,需警惕模型底座自带的立场偏见,并在处理敏感商业或法律咨询时引入独立的中立性评估机制。