「可灵3.0」共找到 6059 篇相关文章
碾压π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架
复旦团队针对当前 VLA 策略依赖模仿学习、真实机器人在线 RL 成本高、传统物理仿真器有局限等问题,提出 ProphRL 框架。该框架以世界模型 Prophet 为核心,结合 RL 算法,为具身智能落地提供更可行路径,实验效果显著。
深度体验TRAE SOLO 正式版,总结一点技巧(附完整可重现提示词和源码)
TRAE SOLO正式版面向国际版所有用户全量上线,模型能力提升且限免。它是响应式编码特工,适合复杂任务。有打通‘行动➔验证’闭环、SubAgent管理上下文等亮点,正式版还有多处升级,作者分享实战技巧。
投85份简历0 Offer!CS研究生心态崩了,亲历20年最猛裁员潮
今年美国裁员破百万,十月裁员规模创2003年来同期新高,AI成背后推手。一机器学习研究生狂投85份简历无果,微软等巨头也加入裁员潮,却仍能实现收益递增,出现“无就业增长的繁荣”。
1300亿美元,买断AGI未来?OpenAI完成5千亿股改,奥特曼0股权
OpenAI完成架构重组,非营利的OpenAI基金会手握1300亿美元股权掌控营利部门。CEO奥特曼直播分享诸多重要内容,如算力目标、研发自动化AI研究员计划等,还谈及平台战略、隐私等议题。
哈佛发现基础模型比你想象中更强大:纯采样方法可超越RL
论文提出基础模型本身已具备强大推理能力,通过“幂采样”纯采样算法,在多推理任务上媲美或超越RL后训练,挑战“RL才能提升推理”观念,为理解基础模型潜力开新视角。
破解空间智能数据稀缺难题,影石开源DiT架构全景生成模型,在线可玩
影石研究院团队推出基于DiT架构的全景图像生成模型DiT360,设计分层混合训练框架,结合透视与全景图像数据,提升真实感和几何一致性。它支持多任务,优于现有方法,为三维场景生成提供新思路。
谷歌杀入诺奖神殿,两年三冠五得主!世界TOP3重现贝尔实验室神话
2025年谷歌关联科学家再获诺贝尔物理学奖,使其两年内收获三项诺奖、五位得主。此前2024年已有三位相关科学家获奖。谷歌成继贝尔实验室与IBM后,最具「诺奖基因」的科技企业。
别让Nano Banana骗了!混合方案让头像生成成功率从0到100%
作者用Nano banana更新头像时发现其生成中文能力差,提出将AI画图与HTML编程结合的方案。HTML搞定确定性、成本低部分,AI画图负责复杂、创意性高部分,还给出使用方法及多种头像加字设计方案。
微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1
微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。
美国CS就业梦碎!狂投5000家0 Offer,名校毕业00后被麦当劳惨拒
科技巨头裁员与AI崛起,美国CS专业就业寒冬来临。毕业生狂投简历难获offer,失业率惊人。AI既削减岗位需求,又让求职陷入怪圈,从业者需探索多元技能。