「人类行为数据」共找到 3718 篇相关文章
2025小结:从RL到Agentic RL
作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。
The Batch: 892 | 教育应与 AI 协作,而非对抗
三年多前ChatGPT发布,教育改变。曾寄望用AI检测器识别生成文本,但学生易规避。检测难维持信任,还可能惩罚错对象。生成式AI可提升学习,应构建新评估模型,如展示真实理解等。
ChatGPT也上线了个人年度报告!
OpenAI 让 ChatGPT 上线「Your Year with ChatGPT」功能,根据用户过去一年对话生成专属年度回顾。报告有数据统计、聊天风格分析、年度奖项等,还能预测 2026 年,虽简洁但数据更私密真实。
数学奥赛高分摘金,位列大模型榜首,『书生』科学多模态大模型Intern-S1能力再升级 | 通专融合新进展
2025年CMO决赛首设AI测试,书生科学多模态大模型Intern-S1以102分位列大模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研。
OpenAI成立10周年!Sam Altman 发文:未来10年一定可以实现超级智能
OpenAI成立十周年,Sam Altman发文回顾点滴与突破。从不确定起点出发,团队克服困难,取得多项成果,推出ChatGPT等。他认为未来一年会有更多成果,再过十年几乎肯定能实现超级智能。
李飞飞站队LeCun,AGI全是炒作!80分钟重磅爆料出炉
李飞飞在Lenny Rachitsky播客中回顾AI发展,揭秘秘辛。她认为AGI是营销用语,世界模型才是未来十年AI前沿。还谈到ImageNet诞生、机器人困境等,其创业公司World Labs的Marble平台应用广泛。
Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒
Anthropic的Alignment Science团队研究大语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越大攻击越易,还对微调数据集实验,引发讨论。
全球68%科研人压力爆表,高校AI人才集体大逃亡!
高校AI科研「内卷」加剧,经费缩水、压力增大。爱思唯尔数据显示68%科研人发论文压力暴增,面临时间与资源双重困境。杜克大学陈怡然教授分享看法,工业界崛起,高校面临转型。
Agent项目最头疼的不是技术,这可能是近期最棒的Agent调研。
MMC深入访谈多家AI Agent创业公司创始人和企业用户,撰写《State of Agentic AI: Founder’s edition》。调研显示创始人头疼的多是非技术问题,还分析了准确率与主动性、定价策略等情况。
TileLang深入详解-第一章-GPU 体系结构复习
作者借长假学习 TileLang 并撰写此文,先复习 GPU 体系结构,包括计算与线程组织、存储层次、专用指令单元,接着介绍核心性能模型与优化原理,最后给出基于 TileLang 的基准测试实践。