「长程任务能力」共找到 4618 篇相关文章
突破三维感知瓶颈:魔芯科技发布VGGT系列成果,实现动态高保真重建并获新一轮融资
魔芯科技联合同济大学等团队,基于 VGGT 架构发布四项成果,突破三维感知在流式处理、动态鲁棒性和精细感知上的瓶颈。还获新一轮融资,后续将加大对空间智能与世界模型技术投入。
NVIDIA 入局量子基础设施:Ising 模型主打自动校准与实时纠错
NVIDIA宣布推出开源NVIDIA Ising模型,解决量子处理器校准和纠错问题。它含校准和解码两组件,速度和准确性优,可本地部署。与传统方法不同,它是与硬件无关的开源模型层,社区反馈有期待也有疑问。
超越Claude Mythos和GPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发
斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness和模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在多基准测试中超越Claude Mythos和GPT - 5.5。
特斯拉开源硬件,中国团队开源大脑!首个具身智能顶配全家桶上线
4月特斯拉宣布人形机器人Optimus技术开放,国内智平方推出全球首个具身智能模型开源社区AlphaBrain Platform,提供全链路技术栈。该平台亮点多,还适配最新具身Benchmark,打破实验室围墙,推动技术突破。
智能体的尽头是Harness基建!上海交大深度解读Harness
上海交通大学等团队深度拆解智能体技术核心演进逻辑,指出智能体落地关键已转移到外部认知基础设施。阐述记忆、技能、协议与运行环境(Harness)如何重塑概率生成,介绍各模块特点及前沿趋势。
刚刚,Claude Code 推出 Routines,让 AI 自动帮你值夜班
Claude Code 上线 Routines 新功能,支持定时、API、GitHub 事件三种触发方式,可叠加使用。它跑在云端,接入外部连接器,面向所有付费用户开放,目前处于 Research Preview 阶段。
静态稀疏已死:Flux Attention 开启长文本 LLM 自适应推理新时代
文章指出长上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。
放弃开源、重组权力!扎克伯格掏出Muse Spark,杀回大模型主桌
Meta在AI发展遇阻后推出Muse Spark,它是MSL首个模型,定位为通向个人超级智能的第一步,性能表现出色,当前闭源,未来Muse系列或有开源变体,标志Meta AI权力结构重塑。
EvoSkills:自进化的skill,是好skill
文章分享两项Agent Skill最新研究论文,指出智能体技能从手工制作向自动进化转变。介绍EvoSkills和EvoSkill两种自动化Skill进化方案,对比其机制、验证方式等,还提及未来研究方向。
让AI自动构建AI模型:UCSD 推出 AIBuildAI 智能体,斩获OpenAI MLE-Bench榜单第一
近日,加州大学圣地亚哥分校研究团队开发 AIBuildAI 智能体,可全自动构建 AI 模型。它在 OpenAI MLE - Bench 基准测试 75 个任务上以 63.1% 获奖率居榜首,实现端到端自动化。