「机器学习算法」共找到 1999 篇相关文章
国庆这8天,我发现和AI辩论才是最高效的学习方式。
作者国庆假期与AI辩论,以自身关于AI时代信息筛选的观点为例,阐述和AI辩论是高效学习方式。先提出观点,后与AI多轮交锋,过程虽痛苦但能促使人思考、完善观点,还给出与AI辩论三步法。
让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源
清华AIR、字节联合团队曾发布DAPO实现大规模LLM强化学习。刘力源、姚峰团队发现DAPO-32B中rollout生成是瓶颈,推出FlashRL,应用INT8/FP8,用TIS解决不匹配问题,加速显著且不牺牲性能,一条命令即可使用。
「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习
近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。
IJCAI-ECAI 2026 开幕:吴佳俊斩获「计算机与思想奖」,SMOTE 算法获首届时间检验奖
当地时间2026年8月18日,第35届国际人工智能联合会议(IJCAI - ECAI 2026)在德国不莱梅开幕。会上颁发多项大奖,如吴佳俊获“计算机与思想奖”,SMOTE算法获首届时间检验奖,还公布论文接收数据,推出早期职业焦点演讲。
让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器
当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。
算法1年翻倍,芯片2年翻倍?重磅实锤:AI正在自我加速,拦不住了
NBER论文证明AI研发自我加速反馈环强度远超其他科技领域,芯片效率每2年、算法效率每1年翻倍。部分自动化就能引爆反馈环,全行业13%自动化率或软硬件17%自动化率可触发奇点,6年内AI可能实现自我迭代。
高效智能体的「幕后推手」是谁?一篇综述带你从记忆×工具学习×规划看透
随着大模型能力提升,业界关注智能体落地,而高效性是决定能否上线的‘硬’问题。论文梳理‘高效智能体’综述,从记忆、工具学习、规划三机制出发,还谈及基准评测、挑战与展望。
红杉的投资哲学和秘密武器,a16z 投了个很有意思的 AI 学习产品
文章分享红杉投资哲学与秘密武器。决策重信念而非共识,管理赋能‘异类’人才,聚焦可控‘输入’,筛选要有勇气。还提到其‘人才佩奇排名’系统,此外介绍a16z投资的AI学习产品。
微软老员工48岁生日被裁,妻子发帖怒斥算法裁人!全球大血洗6000人
微软全球裁员6000人,25年老员工生日当天被算法选中裁掉,他曾修复百万美元漏洞;TypeScript核心成员、AI总监也在裁员名单。微软称与绩效无关,是为简化管理层级,也可能因职位被AI取代。
让Agent画思维导图稳固长期记忆:新框架实现稳定长期学习,准确率提升38%
中国电信人工智能研究院研究团队提出TeleMem框架,从数据结构层重新设计Agent记忆组织方式,使记忆可检索、累积、回溯和演化。该框架解决了传统RAG在长期记忆管理和持续学习方面的瓶颈,准确率提升38%。