手机智能体」共找到 5212 篇相关文章

算法论文8

用「进化+压力测试」自动生成的竞赛级编程题,各家大模型谁更hold住?

北京大学与通用人工智研究院联合提出 UniCode 框架,构建进化式评测系统,自动生成高质量算法题目与抗污染测试用例。通过对 19 个前沿大模型测试,展现高挑战性与强判别力,为代码力评估开辟新路径。

机器之心
算法论文8

挑战Claude4的8B Agent!NUS提出AgenTracer:面向多智体系统的失败归因

随着大语言模型发展,多智体系统潜力大但有系统脆弱性问题。NUS研究者在论文中提出AgenTracer框架,构建标注管线,设计AgenTracer - 8B模型,在失败归因任务上超大型闭源模型,还助力系统自我提升。

PaperAgent
算法论文8

不愧是中国机器人,乒乓打得太6了

清华姚班本科生苏智团队在论文中提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验中击球和回球率高,还连打106拍。

量子位
算法论文8

妙笔生维:线稿驱动的三维场景视频自由编辑

研究人员提出基于线稿的三维场景视频编辑方法Sketch3DVE,相关论文发表于SIGGRAPH 2025。它让用户基于线稿重塑三维场景视频,解决了现有方法个性化不足、真实感差等问题,支持单目图像三维视频合成和二次编辑。

机器之心
算法论文8

超低标注需求,实现医学图像分割!UCSD提出三阶段框架GenSeg

GenSeg用AI生成高质量医学图像及对应分割标注,在仅有几十张样本时也训练出媲美传统深度模型的分割系统,显著降低医生工标注负担。它是通用、与模型无关的框架,可集成到现有分割模型。

新智元
新闻资讯8

Google 悄悄升级了 Deep Think,ARC-AGI-2 直接干到 84.6%

Google DeepMind 升级了 Gemini 3 的专用推理模式 Deep Think,跑分屠榜。ARC - AGI - 2 拿下 84.6%,在多个基准测试中表现优异。它不仅是解题机器,还解决真实科学工程问题,已向部分用户推送,科研人员和开发者可通过 API 使用。

AGI Hunt
算法论文8

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软和 UIUC 合作研究 StudentSim,基于真实学生数据训练个性化学生模拟器框架,解决了过去学生建模方法的问题。它经两阶段训练,在多领域实验中表现出色,还为 AI 教师优化提供反馈。

机器之心
新闻资讯8

永别了,终端!OpenAI疯狂升级Codex,接管Mac人类全程0操作围观

OpenAI的Codex迎来重大更新,从代码工具进化为通用个人助理。开发者实测中,它接管Mac完成多项任务,人类全程0操作。还支持多应用集成,功强大,获开发者青睐,或重新定义使用电脑方式。

新智元
产品应用7

对我来说,Claude Code 就是 AGI

作者分享项目中配置 Google Cloud Pub/Sub 服务的经历,以前动或借助 ChatGPT 操作繁琐,现在用 Claude Code,只需描述问题,它就自动完成分析、操作、验证等,作者认为其某种程度算 AGI。

AGI Hunt
产品应用8

4K超分Agent修图师来了!一键救活所有模糊照片

传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于多智体设计,有感知、复原等模块,为图像定制4K超分方案,在多领域测试中表现出色,无需特定领域再训练。

量子位