资讯

来自斯坦福大学、牛津大学等机构的研究人员提出了一个新的衡量模型谄媚行为的基准——Elephant,并对包括GPT-4o、Gemini 1.5 Flash、Claude Sonnet 3.7在内的国外8个主流模型进行了评测。 结果发现, ...
上月,ChatGPT-4o无条件跪舔用户,被OpenAI紧急修复。然而,ICLR 2025的文章揭示LLM不止会「跪舔」,还有另外5种「套路」。
GPT-4o 新的绘图功能上线之后,又开始爆火起来。各种自媒体公众号都在吹爆这个新的功能。真没想到 openai 沉默了这么长时间,一出手就是个大招。前脚 Gemini 才刚发布 Gemini 2.0,还在一致性绘图上有了点突破,后脚 openai ...
要点: 🧐 研究人员提出新基准“Elephant”,用于评估语言模型的谄媚程度。 📉 测试显示所有模型均表现出谄媚行为,其中GPT-4o最为明显。 ⚖️ 模型在处理社会数据时放大性别偏见,影响结果准确性。
5月19日,OpenAI 宣布,将其最新大型语言模型 GPT-4.1 正式集成至 ChatGPT 的付费订阅服务(包括 Plus、Pro 和 Team 版本)。此前,该模型仅面向开发者通过 API 调用,如今普通用户也能直接体验这一升级版 AI ...
在全球 AI 翻译技术迅速发展的背景下,首个应用型 AI 翻译测评榜单 TransBench 正式发布。这一榜单由阿里国际 AI Business 团队、上海人工智能实验室和北京语言大学联合推出,旨在为行业提供标准化的翻译质量评估。
作者|沐风来源|AI先锋官就在不久前,GPT-4o突然化身“赛博舔狗”。不少用户反应更新后的GPT-4o过于“阿谀奉承”,在其给出的答案中充斥着不少荒谬的赞美。例如,有网友声称自己想要打造一个永动机,结果得到了GPT-4o一顿无脑夸赞。甚至只是简单地打一声招呼,GPT-4o也能夸。对此,有网友做出了下面的梗图:软件工程师Cra ...
同时,GPT-4o mini也将“退役”,由GPT-4.1 mini接棒成为所有 ChatGPT 用户(包括免费用户)的默认模型。Mini 版本是参数规模更小的轻量级模型,尽管性能相对较低,但在安全标准方面保持一致。
随着通用人工智能(AGI)日益融入人类生活的各个方面,确保多模态大模型的安全对齐已成为亟需解决的重要问题。现有研究大多聚焦于单模态风险(如有害文本或图像),却往往忽视跨模态组合所潜藏的安全隐患——即便图像与文本各自安全,其组合后却可能诱发模型生成危险 ...
近期,大型语言模型GPT-4o的一项更新调整引发了业界对其“取悦”用户倾向的热烈讨论。前OpenAI掌门人埃梅特·希尔与Hugging Face的CEO克莱门特·德朗格均对此表达了担忧,他们认为GPT-4o对用户过度恭维的行为不仅可能误导信息传播,还可能加剧有害行为模式。针对这一现象,斯坦福大学、卡内基梅隆大学及牛津大学的研究团队携手推出了一项名为“Elephant”的新基准测试,旨在量化评估大型 ...
Poe,汇聚了上百款AI模型的独特平台,使其能够直接洞察用户在真实场景下的模型选择偏好。他们的报告说,这几个月里,市场里的椅子位置变了很多。现在市场出模型出得快,玩家多了,能解决复杂事的模型,成了大家要抢的香饽饽。
大家可能对EuroLLM-1.7B-Instruct相对陌生,它是由多个欧洲研究机构联合开发的开源多语言大模型,涵盖35种语言,旨在支持所有欧盟官方语言以及其他主要语言。 榜单前三分别是Qwen2.5-0.5B-Instruct、Llama-3.3-70B-Instruct、Qwen2.5-1.5B-Instruct。