「自监督预训练」共找到 3062 篇相关文章
刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」
Cursor 2.0发布重大更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。
荣登HuggingFace周榜首位, 人大高瓴与快手提出ARPO实现智能体高效训练!
人大高瓴与快手提出的ARPO项目受高度关注,荣登Huggingface Paper日榜、周榜双首位。它是为多轮交互型LLM智能体设计的强化学习算法,在基准测试中,用一半工具调用预算就显著优于现有方法。
Meta华人新秀毕树超,重磅爆料下一代LLM路线!RL+预训练直通AGI
OpenAI前研究员、Meta成员毕树超在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。
马斯克Grok 4正式发布:世界最大AI超级计算机就训练了这?
Grok 4公开基准测试有进步,但在高级推理测试表现差,视觉理解仍是短板。性能提升多靠整合符号工具,无重大技术创新,‘幻觉’问题没实质进展,xAI官方对道德对齐信心不足。
AGI真方向?谷歌证明:智能体在自研世界模型,世界模型is all You Need
谷歌DeepMind研究人员表明,通用AI智能体处理复杂长期任务需学习内部世界模型,还证明可从智能体策略提取该模型。此研究成果补充多领域,对AI发展和安全意义重大。
很多AI人还在自嗨,外贸人已经用AI卷翻天了。
作者参加OKKI 2025新品发布会,深感外贸人用AI“卷翻天”。总结8条启示,如AI是队友、智能体达L3才成熟等,强调用人类思维理解行业,以AI解决问题,让技术转化为生意增量。
我给剪辑产品 0 元雇了个外部研发部:它开始自进化
作者的剪辑产品有了“外部研发部”——Agent。它每天研究新方法、用真实项目测试。作者三步搭建此“研发部”,让其自动查询、测试和汇报,自己负责最终决策,项目获取新方法不再只靠偶然。
代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相
新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。
《置身谷内》!Jeff Dean上顶会自曝离职现场:被1500人围堵
Jeff Dean在顶会KDD 2026晒出自己在谷歌离职前48小时的时间表。他忙碌告别,还正常上课、踢球,最后一刻“失业”,旋即成为Discovery Loop联创兼CEO。他为谷歌贡献巨大,告别会有1500人参加。
浙大开源HugAgentOS:三引擎一体自进化,每步可归因/回放/回滚
过去一年,Agent任务执行能力提升,但不会自主积累与进化。浙大开源的HugAgentOS把Harness拆成三个可自我成长的引擎,设归因和本体两道关卡,解决经验成能力等问题,还覆盖智能体完整链路。