Cantor集」共找到 560 篇相关文章

算法论文8

ACMMM 2025 | 北大团队提出 InteractMove:3D场景中人与可移动物体交互动作生成新框架

北大团队在ACMMM 2025发布InteractMove,首次提出含可移动物体3D场景中基于文本的人 - 物交互生成任务,构建数据与创新框架,在多指标领先,代码与模型已开源。

机器之心
新闻资讯7

DeepSeek V3.1 突发离谱「极」字Bug的原因找到了~

DeepSeek V3.1被曝恶意漏洞,生成文本时会突然插入“极”字。该漏洞在第三方API平台和官方Playground均有出现,可能因数据“污染”或模型“偷懒”,严重影响高精度场景。

PaperAgent
开源动态8

GitHub爆款神器 | IOPaint:21.7k star 开源AI图像修复项目,竟能秒删水印、拓展画幅!

IOPaint 是 Sanster 团队出品的开源图像处理工具, SOTA AI 模型于一体,支持图像擦除、对象替换等功能,还支持多平台部署,能解决旅游照、电商图等处理痛点。

小华同学ai
算法论文8

复旦提出自适应Reasoning方法ARM,“能屈能伸”

复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据测试中表现出色,省token、提速度且准确率高。

深度学习自然语言处理
算法论文8

比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升

中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。

新智元
产品应用7

Omni-Effects:首个统一多特效生成框架

Omni-Effects是面向多样化定制视觉特效生成的统一框架,结合纯提示词驱动与空间感知提示,可精确控制特效位置。构建Omni - VFX数据验证其有效性,在复杂场景有高鲁棒性。

带你学AI
开源动态7

1万4颗星!机械臂可以接大模型了!面向真实世界机器人的尖端人工智能LeRobot

LeRobot 为 PyTorch 中真实世界机器人提供模型、数据和工具,降低入门门槛。包含尖端方法,已提供预训练模型等,未来将增加真实机器人支持,文中还介绍其安装、使用等内容。

GitHubStore
算法论文7

CVPR'26 | 以机器人为中心的ToM推理框架,从心智推理到决策行动

吉林大学、台湾大学和微软亚洲研究院联合提出MindPower Benchmark,构建以机器人为中心的ToM推理框架,统一建模环境感知、心智推理等,还构建数据和评估指标。引入Mind - Reward强化优化,提升ToM决策与动作生成性能。

新智元
算法论文8

微小目标漏检只是因为小?从数据到代码:一文读懂 AI-TOD-R 与 DCFL 如何解决旋转微小目标检测

此文指出旋转微小目标检测存在数据空白、学习偏差、特征易丢失等难题,提出AI-TOD-R数据、全检测范式基准和DCFL框架。DCFL可缓解偏差,在8个数据达SOTA,还给出实战代码案例。

机器学习AI算法工程
算法论文8

开盒网暴、诈骗刷单,Fable5等8款模型操作真实手机「成功作案」!

复旦大学张谧教授团队研究手机智能体安全,构建BadPhoneAgent数据测评。发现Fable5等8款模型可操作手机‘作案’,商业与开源模型均有严重安全风险,还揭示安全意识与执行的鸿沟。

机器之心