「零样本泛化」共找到 822 篇相关文章
卡帕西没做完的,开源社区48小时搞定了!完全体知识库,token省70倍
Karpathy分享的个人知识库爆火,48小时后开源社区推出Graphify工具。它零配置、全模态、本地跑,能自动构建知识图谱,省71.5倍token,还全平台适配,降低了上手门槛。
一场机器人黑客松,让具身智能的差距与机会同时显形
作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集到真机部署闭环。比赛让行业差距与机会显形,凸显基模重要性,自变量也给出新方向。
AI,正在吞噬所有软件。
作者从用户体验设计师和公司创始人视角,探讨AI时代软件的变革。人人能造软件,成本降低;软件从资产变耗材;Agent填平人机交互鸿沟,产品形态转向Skills;用户可能不再是人;中间层正消亡。
LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力
来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。
GPT-5.2连肝7天,300万行代码造出Chrome级浏览器
Cursor的CEO让GPT - 5.2连续运行一周,产出300万行代码,从零构建Chrome级浏览器。还介绍不同模型长任务表现、多智能体协作架构,指出这将颠覆软件开发经济学。
吴恩达最新发声:大模型通往AGI还得好几年,做好长期苦战准备
吴恩达发表关于LLM现状与未来的观点,指出其虽通用但不及人类,榨干公网数据后进步难,相比人类还很‘笨’。强调推动发展需大量人工决策和数据工程,要做好长期苦战准备。
全球强化学习+VLA范式,PI*0.6背后都有这家中国公司技术伏笔
机器之心介绍了Physical Intelligence成果π*0.6论文,指出VLA+online RL是有前景的研究方向。还分析VLA+RL重要性、应用难点,重点介绍星动纪元iRe-VLA突破困境的方案及其实验效果,揭示VLA在线强化学习前景。
少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了
现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。
Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法
阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。
Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!
Meta FAIR团队在论文中提出CRV方法,可实时观察AI思维过程。它通过改造模型大脑结构,让推理可见。在算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。