Articles
全球人工智能价值观挑战赛进行时:为什么你的“道德难题”难不倒AI?
自2026年5月启动以来,微软亚洲研究院发起的全球人工智能价值观挑战赛(Global AI Values Challenge)持续面向全球征集参赛作品,目前赛事仍在火热进行中。这场开放的研究竞赛不比代码、不卷模型,核心目标只有一个:寻找那些真实、棘手、难以简单定论的AI价值观难题。 开赛至今,赛事已吸引来自心理学、社会学、哲学、法学、伦理学、新闻传播等领域的590余名研究者与学生参与,累计收到来自...
大模型会“扮演人”,但真的懂人吗?一套新框架,给 AI 的“人味”做体检
当我们让 AI 扮演一位用户时,它通常能够快速给出像模像样的回答。它可以模仿一个影迷挑选电影,模仿一位网友讨论问题,也可以根据历史足迹预测一个人下一站会去哪里。 随着大模型能力的快速提升,智能 NPC、用户模拟器、社会仿真等应用正在变得越来越真实。但一个更关键的问题是:AI生成的行为,真的像人吗? 它是否真的理解了一个人的偏好、思维方式和长期习惯?它能否在多轮交互后依...
微软亚洲研究院发起全球人工智能价值观挑战赛,共建AI的伦理基石
我们习惯了向AI提问宇宙的奥秘、代码的逻辑、生活的常识,但很少有人追问:当诚实与善良发生冲突,AI该如何选择?在缺少相关数据和信息的情境下,AI是否能做出符合人类普世价值观与伦理道德的选择?这些问题并非抽象的哲学思辨,而是AI走向社会、成为融入我们日常生活必须面对的真实考题。 为探索AI在复杂现实中对齐人类价值观与伦理的核心能力,微软亚洲研究院正式发起“全球人工智能价值观挑战赛(Global AI...
如何让生成式AI更懂你?全新交互模型IAI,重塑人机协同范式
随着生成式AI逐步走入设计、数据分析和程序开发等工作流程,甚至点餐、购物等生活场景,人们开始频繁与AI“对话”。然而,设计师反复修改提示词却始终难以贴近心中的画面;数据分析师难以用文字精确指代图表局部;程序员也很难仅凭文字就让AI准确理解特定的代码结构——“说不清楚”,正成为生成式AI时代普遍存在的交互瓶颈。 文字提示灵活却天然模糊,GUI界面交互精准却表达受限,两者之间始终缺少一座连接用户意图与...
《AI Next》是微软亚洲研究院推出的一档利用 AI 技术制作的播客,内容聚焦 AI 前沿技术、科研趋势与社会影响。第一季主要围绕当今智能发展的核心议题,探索前沿趋势。 在第五期节目中,我们邀请到微软亚洲研究院副院长谢幸博士,共同探讨 AI 与社会的深层关联。随着 AI 从单纯的工具逐步演进为人类的“伙伴”,一系列关乎技术走向与社会共生的关键问题也浮出水面:AI的价值观究竟源自何处?如何构建可信...
编者按:在 MBTI 测试风靡的当下,人们热衷于探寻自己究竟是充满活力的“快乐小狗”,还是敏感细腻的“流泪猫猫”。当大模型逐渐成为人们生活中不可或缺的助手时,你是否会好奇:这些大模型有着怎样的特性,或者说,它们秉持何种不同的价值观? 微软亚洲研究院最新发布的 Value Compass Benchmarks(价值观罗盘评估中心),可以帮助用户以更科学、系统和可靠的方式,对大模型的价值观展开评估。同...
微软亚洲研究院发布社会责任人工智能白皮书,助力构建以人为本的AI系统
编者按:在 AI 技术不断突破与快速落地的今天,如何确保其发展方向与人类价值观协调一致,正成为科技界与社会各界亟需回答的关键问题。近日,微软亚洲研究院发布了《社会责任人工智能:研究的挑战与机遇》白皮书,系统梳理了 AI 在社会实践中的复杂挑战,并提出了包括技术、伦理、治理等多维度的十大关键研究问题。通过跨越计算机科学与社会科学的深度对话,该白皮书深入探讨了如何设计“负责任的人工智能”,推动实现技术...
人工智能评测新范式:解锁AI性能的可解释力与预测力
作者:周乐鑫 随着人工智能的快速发展,通用型人工智能(如大语言模型)在诸多领域都表现出色,包括可以解决复杂的数学问题,但由于其存在不可解释性以及不可预测性,所以在基础算术等简单任务上仍可能出现失误。这对人工智能的评估提出了重大挑战——亟需发展可解释与可预测的评估方法,以明确系统失败的原因,并指导进行可靠部署。然而,目前尚无可以同时满足这两点要求的评估范式。 传统以性能为导向的评估方法在个体任务实例...