人在回路」共找到 8785 篇相关文章

算法论文8

ETT:打破原生多模态学习视觉瓶颈,重塑视觉tokenizer优化范式

本文由多机构联合完成,针对传统视觉 tokenization 方法优化与下游任务训练割裂问题,提出 ETT 调优方法。它实现联合优化,多模态理解、生成、重构任务表现出色,虽有局限但带来新突破。

机器之心
算法论文8

灵宝 CASBOT 与 CASIA 共同提出“增强物理机协作中的类意图估计和机角色分配”方法

近日,ICRA 2025 美国亚特兰大开幕,中科院自动化所与灵宝 CASBOT 提出的“增强物理机协作中的类意图估计和机角色分配”方法获录用。该方法解决现有问题,实验显示优势明显,有巨大应用潜力。

InfoQ
开源动态8

1.6K Star!阿里开源 zg:一条命令解决 Agent 时代的本地检索难题。

AI Agent 用 ripgrep 检索常遇难题,因代码命名和自然语言有‘词汇鸿沟’。阿里开源的 zg,将三种搜索能力整合进 CLI 工具,可用于终端与机交互,还介绍了其安装、建索引及搜索的方法。

开源星探
算法论文8

ACL 2026 | OPeRA Dataset: LLM真的能模仿类行为了吗?首次系统评估LLM的类行为模拟能力

美国东北大学等机构研究者提出OPeRA数据集,采集真实用户线购物行为,支持系统评测LLM个体化行为预测能力。实验显示当前主流LLM模拟类行为上表现有限,揭示其能力边界。

机器之心
算法论文8

去掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理

上海交大等团队提出LatentUM架构,摒弃像素解码中介,共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。

AIGC开放社区
算法论文8

告别纯奖励试错!二次尝试+反思蒸馏,复杂任务提升81%

美国南加州大学和宾夕法尼亚大学团队提出新训练范式ERL,将「经验学习」引入强化学习,通过二次尝试和反思蒸馏,复杂任务中性能显著提升,为构建长期自主智能体提供新思路。

新智元
新闻资讯8

黄仁勋CES2026最新演讲:三个关键话题,一台“芯片怪兽”

北京时间1月6日,英伟达CEO黄仁勋CES2026演讲。回顾过去一年开源模型发展,本次围绕系统与基础设施、模型、应用落地三条主线演讲,展示Rubin架构等成果,推动推理型AI发展及应用。

芯师爷
算法论文8

谢赛宁REPA得到大幅改进,只需不到4行代码

Adobe Research等团队对REPA展开研究,发现驱动目标表征生成性能的是空间结构而非全局性能。基于此构建iREPA,代码不到4行,能提升REPA收敛速度,多方面表现出色。

机器之心
新闻资讯8

写代码写出26亿身家、“淘宝第一个程序员”多隆离职后重出江湖,加入老同事创企,“杀入”AI赛道!

技术大牛多隆离开效力25年的阿里,于8月6日加入贝联珠贯,投身AI赛道。他曾是“淘宝第一个程序员”,一路走到阿里P11、成为合伙,身家达26亿。此次他将和老同事毕玄用AI Agent改写运维服务格局。

AI科技大本营
产品应用7

AI又来带货了!字节推出DreamActor-H1自动对齐手势和商品

电商和数字营销领域,现有框架呈现效果不佳。字节推出DreamActor - H1框架,基于扩散变换器,集成Seaweed - 7B模型,能生成高保真机交互视频,有效果突破但也存局限。

带你学AI