「线索引导式反思」共找到 217 篇相关文章
清华、快手提出AttnRL:让大模型用「注意力」探索
清华和快手团队提出新框架AttnRL,引入注意力机制提升过程监督强化学习效率与性能。它解决传统方法在分支位置选择和采样策略上的效率问题,实验显示在多基准测试中表现优异。
把AI变成你的科研搭子,公益培训启动报名!
面对科研难题,AI科研加速营招募启动。由上海人工智能实验室等主办,公益开放。以真实科研任务为主线,用“书生·端砚”实践,课程覆盖多领域,学员可获多种权益。
OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家计划在瞄准谁?
今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部大模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。大模型下半场比拼基础研究,构建评测基准很重要。
Fable 5榜单第一靠作弊?代码泄露,模型真实身份曝光
黑客泄露Claude Fable 5长达12万字符的系统提示词,揭示它并非大模型,而是伪装成LLM的完整Agent系统。这颠覆了对AI模型的认知,也让Anthropic陷入舆论漩涡,还暴露了其计费黑幕。
黄仁勋100万亿预言兑现!易鑫Voice Agent落地,汽车金融迎效率革命
2024年GPT - 4o问世后,Voice Agent创业公司涌现,但通用方案在金融等场景「水土不服」。易鑫深耕汽车金融,自研工业级Voice Agent系统,采用Model + Harness方法论,实战数据亮眼,还将向泛金融领域延伸。
陶哲轩亲自曝光:AI破解数学难题,竟全是「抄」的?
数学大神陶哲轩发现,AI声称破解的Erdos难题,实则是多年前已被人类解决的旧闻。他指出当下AI进化逻辑并非创新,而是利用算力扫描人类文献的‘长尾黑洞’,其核心价值是填补人类知识遗忘漏洞。
"Slop"当选年度词汇:AI垃圾内容有了正式名分
韦氏词典宣布“slop”当选2025年度词汇,指AI生成的低质量数字内容。过去一年它频繁用于形容AI内容,如今AI生成网络文章占比超50%,还催生“slop经济”,但AI内容或优胜劣汰。
Learn to Reason _ The way of Baichuan-M1-ClinicReasoning
前百川智能研究小组负责人阎栋分享大语言模型临床推理。回顾推理技术发展,以Deepseek为例;介绍百川在医疗推理实践,模型达三甲主治水平;还谈及大模型训练困境及与人类智能差异。
深度解读《AI 智能体的上下文工程》:构建高效 Agent 的七个宝贵教训
作者解读 Manus 团队文章,结合自身理解总结出构建高效 Agent 的 7 个关键点,如依赖上下文工程、提升 Prompt 缓存命中率等,还给出总结与核心启示,对 Agent 开发有借鉴意义。
SOTA级视频编辑新方法:无需训练一句话编辑视频,背景保持100%
传统视频编辑工作流被AI重塑,但现有AI方法存在问题,多源于反演 - 编辑范式。西湖大学AGILab提出无需反演和训练的FlowDirector,开销低、支持广且能100%保持背景,还采用新策略优化。