「分镜能力」共找到 3743 篇相关文章
美国版梁文锋来了
美国互联网券商巨头Robinhood的CEO Vlad Tenev投身AI创业,与Tudor Achim联合创立Harmonic AI,从数学突破开始,目前已完成B轮融资,估值达8.75亿美元,目标是构建数学超人类的AI系统。
大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱
CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。
苹果港大终结自回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!
苹果联合港大开源扩散大语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。研究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。
如何让 AI 成为你的编程搭档?一次真实重构告诉你答案
文章介绍编程工具Cursor,它是基于VS Code、深度集成AI的智能代码编辑器,有多种模式,能力强但有局限。作者分享用其完成重构需求的过程、经验,还提及使用中踩坑及应对方案,最后总结提效成果。
纳米 AI 梁志辉:超级搜索智能体是 AI 时代的真正入口
纳米AI梁志辉认为超级搜索智能体是AI时代真正入口。纳米AI推出的「超级搜索智能体」结合多Agent协作等能力,是新解决方案。演讲分享了360对AI搜索、智能体搭建及浏览器的看法与探索。
百度在 AI IDE 上的决心
百度发布国内首个多模态、多智能体协同的AI IDE:Comate AI IDE。其功能完备,百度在AI IDE赛道决心大。随着模型和Agent能力提升,百度认为未来IDE竞争本质是Agent竞争,其早有相关布局。
120亿腾讯系AI独角兽冲刺港股IPO,北大数院校友创业19年,包揽27%世界500强客户
估值120亿的上海AI独角兽明略科技准备在港交所上市。它由北大数院校友创业19年,获腾讯等投资,客户涵盖27%世界500强。其产品分营销、营运智能和行业解决方案三类。
无需人类插手!AI战队自主进化,人类玩家瑟瑟发抖
论文《Agents of Change: Self - Evolving LLM Agents for Strategic Planning》以桌游《卡坦岛》为“考场”测试AI战略能力。研究团队设计四代AI特工,实验显示能自我进化的AI完爆静态AI,不过也存在计算成本高、依赖基础模型等问题。
一招缓解LLM偏科!调整训练集组成,“秘方”在此 | 上交大&上海AI Lab等
上海交大和上海AI Lab联合团队提出IDEAL方法,可提升LLM综合性能。研究发现SFT阶段数据数量非关键,配比不当会加剧模型“偏科”。以Llama3.1 8B测试,IDEAL能提升代码能力,还指导了超参数选取。
1.93bit版DeepSeek-R1编程超过Claude 4 Sonnet,不用GPU也能运行
1.93bit量化后的DeepSeek - R1(0528)编程能力超Claude 4 Sonnet,在aider榜单获60分。Unsloth工作室制作9个量化版本,小版本不用GPU也能跑。R1 - 0528在游戏评测中表现也佳。