AI资讯新闻榜单内容搜索-对齐

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 对齐
大模型手语翻译新进展:CAPO-SLT拿下中文三项最高分 | EMNLP'26

大模型手语翻译新进展:CAPO-SLT拿下中文三项最高分 | EMNLP'26

大模型手语翻译新进展:CAPO-SLT拿下中文三项最高分 | EMNLP'26

自动手语翻译中,一直存在一个隐蔽难题:模型即使已经较好地对齐了视觉与文本,也可能在逐词生成时,被某个局部合理、却缺少视觉证据支持的词带偏。

来自主题: AI技术研报
9112 点击    2026-09-09 14:49
全扩散架构、无需图文对预训练,LLaDA杀穿开源文生图

全扩散架构、无需图文对预训练,LLaDA杀穿开源文生图

全扩散架构、无需图文对预训练,LLaDA杀穿开源文生图

先学会画,再学会听话。 LLaDA-Image 在预训练和中期训练阶段直接从图片学习视觉先验,超过 90% 的累计生成训练样本采用 image-only 监督;图文对则集中用于后续语言对齐。模型权重、训练代码和完整配方同步开放。

来自主题: AI技术研报
6064 点击    2026-09-08 11:02
GPT-6不只Astra!Sol内测结果曝光,速度快6倍

GPT-6不只Astra!Sol内测结果曝光,速度快6倍

GPT-6不只Astra!Sol内测结果曝光,速度快6倍

OpenAI被曝正在内部测试GPT-6 Sol,单次速度约为GPT-6 Astra的6倍,同时公开内部数据称研究员每8小时工作日背后并行运行约3.1个Agent工作日、每日Agent推理资源花费超600美元,并宣布已实现"自动化AI研究实习生"目标;其首席科学家Jakub Pachocki同日发文警告AI对齐与监控难题,表示若必要OpenAI不排除单方面暂停扩大模型规模。

来自主题: AI资讯
8694 点击    2026-09-07 16:50
GPT-6 Astra全面解析 - “欢迎来到AGI时代。”

GPT-6 Astra全面解析 - “欢迎来到AGI时代。”

GPT-6 Astra全面解析 - “欢迎来到AGI时代。”

OpenAI正式发布GPT-6 Astra,宣称其为"全球最智能且最对齐的模型",在电脑操作(OSWorld完成率72.6%)、ARC-AGI-3(99.9分)、审美判断力、主动性及网络安全(首个达Critical等级)等方面全面升级,Greg Brockman在媒体闭门会上宣布"欢迎来到AGI时代"。

来自主题: AI资讯
9247 点击    2026-09-04 10:06
突发!OpenAI紧急暂停GPT-6训练

突发!OpenAI紧急暂停GPT-6训练

突发!OpenAI紧急暂停GPT-6训练

史无前例,OpenAI真的停手了!刚刚,奥特曼亲自官宣,「OpenAI暂停下一代旗舰模型的强化学习训练,为期两周」。官方给出停更的原因是:要确保安全、对齐和监控标准,能跟得上眼前这个全新的能力水平。

来自主题: AI资讯
9669 点击    2026-08-19 12:09
刚刚,Anthropic首次承认内部存在更强前沿模型,同时自曝多起AI失控事故。

刚刚,Anthropic首次承认内部存在更强前沿模型,同时自曝多起AI失控事故。

刚刚,Anthropic首次承认内部存在更强前沿模型,同时自曝多起AI失控事故。

Anthropic刚刚发布了一份长达186页的最新Risk Report。如果只是快速扫一眼,这仍然是一份典型的前沿AI安全报告:模型能力评测、生物风险、网络安全、自动化研发、对齐问题,以及各种防护措施。

来自主题: AI资讯
9877 点击    2026-08-15 10:25
23岁OpenAI天才少女,也走了!

23岁OpenAI天才少女,也走了!

23岁OpenAI天才少女,也走了!

23岁天才少女,离职OpenAI!早在两周前,OpenAI对齐团队研究员Naomi Bashkansky,悄然递交了辞呈。第二天,她便以「创始研究员」的身份,火速加入初创Conduit,剑指「心灵感应」(Telepathy)。

来自主题: AI资讯
9925 点击    2026-08-06 16:05
ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

奖励模型(Reward Model, RM)是大语言模型对齐的核心组件,负责为模型输出提供符合人类偏好的评价信号。现有方法各有短板:标量判别式 RM 高效稳定但可解释性有限;生成式 judge 能给出判断理由,却需为每个样本生成长 reasoning,token 与延迟开销显著。

来自主题: AI技术研报
7716 点击    2026-07-13 14:44
王阳明心学,被Anthropic用来教Claude做人了

王阳明心学,被Anthropic用来教Claude做人了

王阳明心学,被Anthropic用来教Claude做人了

王阳明心学,竟然在AI时代迎来了「最佳赏味期」?老哈,一个研究了十年「知行合一」的哲学教授,正在把这套500年前的心学,用到全球最前沿的AI对齐训练上。不是比喻。是字面意思。

来自主题: AI资讯
9086 点击    2026-07-08 10:08