人在回路」共找到 8750 篇相关文章

开源动态8

机器需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代

2026 WAIC落幕,具身智能成焦点。当前VLA模型长程任务中有局限,上海创智学院和智元机器联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,长程任务表现出色。

机器之心
算法论文7

SOTA大模型遇上加密数据评测:Qwen3未破10%,o1也栽了丨上海AI Lab等联合研究

当前推理模型基准测试中性能卓越,但密码学领域推理能力待探索。上海AI Lab等推出CipherBank评测,用海量真实隐私场景数据和多类型密码算法挑战SOTA大模型,结果显示模型表现不佳,还分析了模型“犯难”原因。

量子位
产品应用8

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT - 5.2 登场,有 Instant、Thinking、Pro 三个版本,多方面大幅升级,能覆盖 44 类专业工作。它经济性强、编程能力佳、推理出色,但存速度慢的问题,其价格 API 端有调整,未来还将推 Codex 优化版。

AI前线
算法论文8

四足机器首次同时「思考+走路」,北大提出链式推理MobileVLA-R1

「大模型+机器」浪潮中,让机器既听懂话又走得对、稳很难。北大MobileVLA - R1将链式思考引入四足机器仿真和真实实验中对标强基线实现提升,构建了更具工程可用性的范式。

新智元
算法论文8

AI已经开始自己设计算法,并且超越顶尖类专家,类还能做什么?

谷歌DeepMind团队与加州大学伯克利分校研究显示,AI能设计出超越类专家的算法。如多个领域案例中,AI设计的算法成本、效率等方面表现出色。ADRS方法将系统研究核心环节自动化,类研究员角色也将转变。

AIGC开放社区
开源动态8

YOLO12改进引入DINOv3少样本目标检测精度飙升,分享训练自定义数据集代码

Meta 工智能研究院的 DINOv3 是基于自监督学习的视觉大模型,解决诸多问题且无需微调,多任务表现出色。将其引入 YOLO12 后,不同规模数据集上检测性能显著提升,还分享训练自定义数据集代码。

机器学习AI算法工程
开源动态8

更大,还能更快,更准!蚂蚁开源万亿参数语言模型Ling-1T,刷新多项SOTA

10月9日,蚂蚁开源万亿参数语言模型Ling-1T。它延续自研高效MoE架构,编程、数学推理等多维度测试表现亮眼,还能兼顾精确与效率。此外,它多场景实用性强,其创新设计提升了能效比与性能。

机器之心
新闻资讯8

预测太阳磁暴全球最强!首个空间天气链式AI预报模型亮相WAIC

WAIC上,我国发布全球首个全链式空间天气AI预报模型“风宇”。它首创链式训练结构,整合孤立环节;基于天地一体化观测数据,多区域短临预测表现卓越,误差低,已申请多项专利,还可用于航天器设计管理。

量子位
算法论文8

0.016%参数撬动18%性能:关键表征微调破解LLM推理瓶颈

大语言模型推理任务依赖思维链技术,传统PEFT方法需修改大量参数,新兴ReFT虽只需调整少量参数,但存不足。本文提出CRFT,仅用0.016%参数量就提升性能,为轻量化推理增强开辟新路径。

深度学习自然语言处理
新闻资讯7

Kimi K2里找到了DeepSeek V3架构

Kimi新模型K2热度高,多benchmark上达SOTA,网友好评多。Kimi工程师透露K2开源原因,还谈及Kimi发展策略。实测显示K2前端制作、工具调用、创意写作上表现出色。此外,OpenAI开源模型推迟,引发猜测。

量子位