「人类偏好对齐」共找到 1411 篇相关文章
工作场景AI化,一个月花100美元订阅AI工具值吗?
AICon 全球人工智能开发与应用大会 2025 北京站即将召开,InfoQ 直播栏目邀请来也科技胡一川、阿里汤威、美团邹明远、快手王东旭探讨 AI 时代「10x 个体」与「10x 组织」,分享落地路径、效率提升及工具使用经验。
AI为啥不懂物理世界?李飞飞、杨立昆:缺个「世界模型」,得学大脑新皮质工作
近来,杨立昆计划离开Meta创立以‘世界模型’为核心的AI公司;此前李飞飞也发文指出大语言模型弊端,强调建立‘世界模型’重要性。该模型源于对大语言模型局限的反思,能让AI理解物理世界。
这些大神在Meta的论文看一篇少一篇了
田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。
AI写论文,AI评阅!AI顶会ICLR完成「AI闭环」,1/5审稿意见纯AI给出
在号称「史上最严管控AI」的顶级会议ICLR 2026上,超五分之一审稿意见由大模型一键生成。这发生在ICLR颁布史上最严LLM规定后不久,引发诸多争议,也凸显AI改写科学评审分工的趋势。
与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本
NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。
AI 产品范式探讨:非线性思维、多 Agent 协作才是复杂任务的更优解
本文探讨AI产品范式,指出当前大模型产品设计多将其视为‘万能单兵专家’,但复杂任务下效果不佳。提出群体智能、非线性思维等观点,阐述人机协作方向,介绍新范式及AI产品商业化核心是信任。
AI 原生初创公司,都把钱花在了哪些 AI 产品上?
a16z与Mercury合作调研,基于超20万客户数据库,分析2025年6 - 8月支出模式,筛选出50家AI应用层公司。榜单揭示AI在产品与工作流的落地情况,显示早期创业公司愿买单的AI应用方向。
Hinton自曝:前女友提分手,用ChatGPT列出自己「七宗罪」
近日,人工智能教父杰弗里・辛顿透露前女友用ChatGPT列他“七宗罪”后分手。他日常用ChatGPT工作研究,还重申从谷歌离职是因退休,同时警告AI会致失业、有毁灭性打击风险。
精准医疗与AI融合:数据驱动下的个性化健康未来|甲子引力X
在「2025甲子引力X中国科技产业投资大会」上,5位投资人围绕AI赋能医疗投资的机遇与挑战展开探讨。他们各有投资偏好与见解,还指出风险,最后畅想了AI改造后的健康未来。
EMNLP 2025 | 动态压缩CoT推理新方法LightThinker来了
随着AI发展,大语言模型处理复杂推理任务能力提升,但推理产生大量中间步骤和文本,拖慢计算速度、增加资源压力。研究者提出LightThinker,模仿人类思考模式,动态压缩推理步骤,削减tokens数量,降低成本。