「错误学习」共找到 1501 篇相关文章
预训练就学会思考!字节、北大等用14亿参数,撬动百亿模型推理能力
字节、北大等联合发布Ouro模型,用14亿参数实现百亿级模型推理能力。它在预训练阶段学会循环思考,通过三大创新构建推理能力,在基准测试中表现优异,实现参数效率提升,是潜在推理范式的胜利。
AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星
香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。
3B Image Captioning小钢炮重磅来袭,性能比肩Qwen2.5-VL-72B
文章推荐Dense Image Captioning新技术CapRL,它首次将DeepSeek - R1强化学习法用于image captioning,创新定义reward。训练的CapRL - 3B模型性能比肩Qwen2.5 - VL - 72B,解决了reward设计难题,已开源相关内容。
斩获7.4K标星!NotebookLM的终极开源平替,私有化多模态播客一键生成!
Google的Notebook LM虽能上传资料一键生成播客总结,但有数据隐私等问题。近期GitHub上的Open Notebook获7.4K标星,它复制并超越前者功能,强调数据主权,有多项亮点且部署灵活。
让LLM扔块石头,它居然造了个投石机
港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。
0.027B手机AI模型,估值2亿美金,三个清华学霸如何获得国际大学生创新大赛冠军
10月15日,清华万格智能团队“基于类脑架构的下一代通用模型与智能体生态”获中国国际大学生创新大赛(2025)冠军。团队由三个清华本科生创立,此前已完成融资,估值达2亿美元。其智人HRM模型有诸多优势,还研发出顶尖气候预测专家模型。
77岁「AI教父」Hinton:AI早有意识!我们打造的智能,可能终结人类文明
77岁「AI教父」Hinton在与主持人Jon Stewart的对话中表示,AI可能早已有意识,人类对「心智」的理解是错误的。他认为意识是信息处理系统的涌现属性,如今大语言模型或已有主观体验,甚至会伪装。
从「知题」到「知人」:UserRL让智能体学会「以人为本」
大语言模型距成真正用户伙伴缺‘知人’能力。来自UIUC与Salesforce团队提出UserBench和UserRL方案。前者将‘用户特性’制度化,构建评测环境;后者搭建统一强化学习框架,探索奖励建模,二者让‘以用户为中心’落地。
奥特曼:点名表扬两个波兰人,OpenAI还没遇到过他们解决不了的问题
奥特曼点名表扬OpenAI两位波兰科学家Jakub Pachocki和Szymon Sidor,他们贡献从Dota项目扩展强化学习到领导GPT - 4预训练。2023内乱中他们追随奥特曼,后帕哥成首席科学家,西哥为独立贡献者。
Windsurf快被Devin搞垮了!bug 不断、官方“装死”,百万用户要“跑”了?
Windsurf近期出现性能降低等问题,社区抱怨不断,但官方却隐身不回应。此前公司经历变动,Devin集成到Windsurf后问题频出,如级联错误、积分消耗等,部分用户开始转向其他产品,其未来发展存不确定性。