代码能力评测」共找到 4821 篇相关文章

算法论文8

告别海量标注!浙大团队提出GUI-RCPO,让GUI定位在无标签数据上自我进化

浙大等机构研究人员提出GUI - RCPO,这是自我监督强化学习方法,能让模型在无标注数据上提升GUI grounding能力。其通过迁移思想,利用区域一致性自我提升,实验表明该方法有效且有泛化能力

量子位
推荐文章7

如何让AI推荐企业官网?官网GEO优化怎么做?【必看】

白杨SEO从网站代码优化、站内内容、站外推广三方面,介绍让AI推荐企业官网及做好官网GEO优化的方法。如代码优化要主动提交网站、部署SSL证书等,还给出企业官网老板执行清单。

白杨SEO优化教程
算法论文7

Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型在多任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率。

AINLPer
产品应用8

8岁小孩哥「聊出」操作系统,一部手机、几句话,原生App直接生成

8岁小孩扑满借助秒哒做出「操作系统」雏形,百度2026 Create大会上秒哒3.0迎重要升级,从移动端、原生App、企业版、Agent能力四个维度重构,降低开发门槛,提升能力至生产级。

机器之心
新闻资讯7

Manus卖给了Meta!年初火爆年底数十亿美元被收购

Meta和Manus官网宣布,Meta收购Manus以提升通用Agent能力。此次收购费用数十亿,是Meta第三大收购案。Manus产品以“通用Agent”为核心叙事,今年先爆火、融资,后迁总部,最终被收购。

量子位
推荐文章7

AI一边平权,一边拉开差距

互联网大佬爱讲“AI平权”,却没说AI变强、获知识门槛降低时,人和人差距反而拉大。决定差距的关键是提问力等三个能力,真正的提问力是对问题“形式化定义”的能力

newtype AI
开源动态8

给Agent装上“海马体”!上海AILab开源MemVerse,定义多模态记忆新范式

上海人工智能实验室开源MemVerse,这是首个面向智能体的通用多模态记忆框架。它将多模态信息与文本对齐到统一语义空间,首创‘双通路’架构与‘记忆蒸馏’技术,让智能体有终身记忆能力,在多模态任务中表现出色。

量子位
产品应用7

真正的Jarvis要来了?涂鸦智能押注Physical AI

智能家居爆发期,诸多硬件品牌借涂鸦能力发展。如今涂鸦发布AI生活助手“Hey Tuya”,它依托自研架构补齐Agent进入物理世界的关键能力,让涂鸦从幕后走向台前,有望构建家庭生活新基础。

AI前线
产品应用8

VC、品牌顾问、编剧,正在批量把自己做成AI

AI发展中普通人使用门槛抬高,供需错配。5月19日袋袋(Profy)上线,专家说出经验就能封装成“数字专家”。它有四层能力和独特架构设计,让判断力独立流通,赋能普通用户。

量子位
开源动态8

Qwen-AgentWorld:一个语言世界模型,模拟七大Agentic领域

今天正式发布 Qwen-AgentWorld,它是首个原生语言世界模型,能在七大领域模拟智能体交互环境。同步发布 AgentWorldBench 评测基准。Qwen-AgentWorld 经三阶段训练,在评测中表现出色,还探索两种范式增强通用智能体能力

千问大模型