「人类偏好对齐」共找到 1411 篇相关文章
“软件比白领更先被 AI 击穿”!Anthropic CEO 最新改口,反讽马斯克危言耸听,两大佬隔空互掐
Anthropic获300亿美元G轮融资,马斯克怒怼其AI有“厌世、反人类倾向”。Anthropic CEO Dario Amodei暗讽马斯克“危言耸听”,改口称软件比白领更易被AI击穿,还探讨了AI在医疗、经济、民主等方面的影响及风险。
震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?
BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩大模型。
【栏目对话和访谈】Sebastian 和 Nathan 在 Lex Fridman 播客深度解读 AI 现状:中美竞争、模型对比、规模定律、AGI 时间线
Sebastian 和 Nathan 在 Lex Fridman 播客中,用 4 小时深度解读 AI 现状,涵盖中美竞争、模型对比、规模定律、AGI 时间线等热门话题,还分享了入行建议、工作文化等多方面观点。
Anthropic让AI先读员工手册再上岗:失控率从54%降到7%
Anthropic最新研究「模型规范中期训练」(MSM)显示,相同训练数据配不同行事原则,模型表现不同。MSM在预训练和对齐微调间加中间阶段,让模型读规范文档理解准则,在特定实验中,将Agent失控率从54%降到7%。
仅4人28天!OpenAI首曝Sora内幕:85%代码竟由AI完成
OpenAI团队揭秘安卓版Sora APP构建内幕,4人团队28天完成从0搭建,约85%代码由AI智能体Codex完成。Codex可自我迭代,在多方面表现出色,但也需人类指导。团队分享了与Codex协作的经验和技巧。
陶哲轩亲测!GPT-5 Pro 40分钟破解3年难题,登顶最难数学考试
数学家陶哲轩将几何难题交给GPT - 5 Pro,虽推理完美但无解。同一周,GPT - 5 Pro在FrontierMath测试集夺冠。陶哲轩测试发现AI在科研不同层面表现有别,也揭示了AI理解力受限及人类与AI的分工边界。
“今天的OpenAI,就是昨天的Sun!” 杨立昆最新长谈:像Linux击溃微软一样,开源AI终将统治世界
图灵奖得主杨立昆在万字对话中阐述AI逆行逻辑,认为LLM非通向人类智能的道路,因其缺乏预测行动后果等能力。他离开Meta创立AMI Labs,专注世界模型和JEPA架构,还介绍Tapestry项目,主张开源AI将统治世界。
让AI创作不千篇一律,提示词随机插词汇就行
最新研究发现,在AI开写前由人类提供开头或随机插入词汇,写作效果会更多样,AI写作同质化或因“启动条件”问题。研究创建三类同质化评价指标,还发现向系统提示注入随机词汇可提升模型输出多样性。
“软件比白领更先被 AI 击穿”!Anthropic CEO 最新改口,反讽马斯克危言耸听,两大佬隔空互掐
Anthropic获300亿美元G轮融资,马斯克怒怼其AI“厌世、反人类”。Anthropic CEO Dario Amodei暗讽马斯克说法“危言耸听”,还改口称软件比白领更易被AI击穿。此外他还谈了AI在多领域的影响及风险应对。
刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来
OpenAI 十周年推出 GPT - 5.2 系列模型,包括 Instant、Thinking 和 Pro 版本。它在多方面表现出色,刷新多项基准测试 SOTA 水平,如 AIME 2025 获满分,在 GDPval 达人类专家水平。还在编码、视觉理解等能力上有显著提升。