「泛化推理能力」共找到 4722 篇相关文章
港股新贵押注物理AI,乐动机器人打造万亿市场空间的核心基础设施
物理AI时代,机器人需「读懂」物理环境,环境感知能力成竞争焦点。乐动机器人过去十年围绕此布局,有空间感知技术先发优势,其自研模型与架构构建数据飞轮,有望完成向感知基础设施平台的身份重塑。
生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务
生数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生数科技双轨布局,Vidu与MotuBrain同根。
AI破解500年《纽伦堡编年史》天书!仅用1小时,隐藏惊天真相被揭开
500年前《纽伦堡编年史》中的手写注释难倒人类学者,Gemini 3.0 Pro仅用1小时就给出解读,识别出注释与圣经年代学体系计算有关。它攻克视觉识别、解读缩写、还原历法转换表三大难题,展现惊人能力。
首个开源实现100%可复现的稳定RL训练框架来了!2次结果完全重合
SGLang团队联合slime团队开源实现100%可复现的稳定RL训练框架。基于Qwen3 - 8B重复实验结果完美重合。SGLang在批次不变算子基础上实现确定性推理,性能有下降但有提升空间,还给出使用方法和未来规划。
抢先体验GenFlow2.0:未来多Agent协作的理想形态
作者在百度邀测会抢先体验Genflow 2.0,用其解决小学教改信息查询问题,还让它生成创意图片。它得益于“沧舟OS”,有流畅、并发且跨模态能力,架构全自研,测试版亮点多,值得期待8月正式上线。
全球首创!B站推出影视级TTS语音模型,支持零样本语音+情绪双克隆,精准时长控制!
近日,B站语音团队推出全新一代语音合成模型IndexTTS2,提供影视级音质、情绪克隆和时长控制。其情绪与时长精细控制功能全球首创,还具备零样本语音克隆等能力,支持本地运行与中英文双语。
Grok 4基准测试被爆极其优异,人类终极考试成绩飙升到45%,碾压o3 和Gemini的20%
API开发者曝光Grok - 4和Grok - 4 Code测试成绩,HLE达35%,推理后飙升到45%,远超o3和Gemini的20%。其他测试也表现优异,但成绩引发争议,有人质疑数据污染,也有人支持,目前数据未官方证实。
快问快答|AI都会写代码了,还要不要报考计算机专业?!
在AI大模型能写代码的背景下,InfoQ采访王昊奋、谭晓生、邹欣,探讨高考是否报考计算机专业。他们就专业前景、核心价值转变、核心能力等发表看法,还提及课程调整和其他专业选择。6月30日直播将深入探讨。
近 300万人围观卡帕西亲测 Opus 5:两小时写完 5500 行代码, 却连自己写的游戏都玩不了
8月2日,Andrej Karpathy在X公布实验,让Claude Opus 5用Three.js将《指环王》第一章渲染成3D场景,约两小时写出5500行代码。Opus 5按传统游戏开发路线搭建场景,这改变了内容定制方式,但模型验证能力不足。
模型越强,人的判断力越值钱:微软CEO破解“AI替代”焦虑
微软CEO纳德拉长文探讨‘AI驱动的经济中企业的未来’,指出企业要构建AI学习闭环,让人力资本和AI能力叠加增长。还提出认知闭环概念,强调人的判断力在AI时代更有价值,给出构建学习系统的具体方法。