「研究Agent」共找到 4385 篇相关文章
直播预约 | 迈向用于演绎推理的诚实语言模型
本次讲座聚焦迈向用于演绎推理的诚实语言模型。当前语言模型难诚实推理,输入不足会产生无根据答案。为此制定多步骤任务,提出强化学习方法ACNCHOR,稳定学习过程、提高推理性能。
AI 行业最新的 18 个前沿认知
文章整理了火山引擎AI领航者计划活动中,大厂、投资人和创业者对AI行业的18条前沿认知,涵盖模型层、应用层和产业层,如强化学习成竞争焦点、视频生成将崛起等,展现2026年行业新趋势。
Stanford、Meta和Google等发现LLM存在五大天花板,再扩算力已无用
论文《On the Fundamental Limits of LLMs at Scale》指出,LLM性能提升有理论天花板,扩展中会遇幻觉、上下文压缩等五大根本限制,源于计算、信息与学习理论,未来应转向‘有限优化’。
田渊栋离职Meta,最后一篇论文?
离职Meta后,田渊栋团队论文被NeurIPS 2025录用。研究提出「三门理论」,发现RLVR微调在小权重发力,不破坏模型结构,还绘制出RLVR训练动态的「参数层面全景图」。
LeCun在Meta的最后一篇论文
LeCun于11月11日提交最新论文《LeJEPA:无需启发式的可证明且可扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。
基于DINOv2和SAM2改进的U-Net模型
DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。
字节推出X-Streamer,实时口型同步与长程记忆数字人框架
字节推出端到端多模态人类世界建模框架X - Streamer,能从单张人像构建可无限流式生成的数字人,实现音素级口型同步和长程记忆。其核心是“思考者–行动者”双Transformer架构,在两张A100 GPU上可实时运行。
突发!Claude 4.5 发布,这次更新不止是模型!
Anthropic发布Claude 4.5,在编程等任务中表现优于GPT - 5。Claude Code升级,API添新功能,模型能力提升,对齐性改善。还推出Claude Agent SDK及“Imagine with Claude”功能。
一半人明天不上班,GDP不会掉一点!耶鲁大学揭AGI残酷真相
耶鲁学者Restrepo论文指出,AGI时代经济因算力扩张狂飙,但普通人工资被「算力成本」锁死,与增长脱钩。劳动在GDP占比将归零,财富流向算力资本,人类或被边缘化到附属岗位。
腾讯悄悄上线了“Claude Code”,居然还支持微信登录。
腾讯悄悄上线CodeBuddy Code(Claude Code),定位为AI CLI,能在命令行完成编程任务。作者测试用其开发MCP服务,速度快且功能全,还介绍使用方法,不过产品有稳定性问题,仍有潜力。