「多步决策」共找到 4451 篇相关文章
把AI 时代最重要的判断力当专业学科训练,专注提升判断力
文章指出AI时代人们多只有“领域内判断力”,判断力可当学科训练。介绍预测大赛中普通人表现超CIA分析师,1小时训练能提升10%准确度,还给出判断力3层栈框架及30天训练清单。
何恺明首个语言模型:105M参数,不走GPT自回归老路
何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。
谷歌推出Googlebook:为Gemini重新造一台笔记本
谷歌宣布推出全新笔记本产品线Googlebook,专为Gemini AI打造。它融合Android和ChromeOS体系,有Magic Pointer等新功能,与Android手机协作顺畅,还新增Quick Access功能,首批设备由多厂商合作生产,今年秋季发布。
完全运行在浏览器中的全功能 3D 建筑编辑器无需 AutoCAD\Revit,也无需每年 5,000 美元的授权费用,100%开源免费
Pascal Editor是完全在浏览器运行的3D建筑编辑器,开源免费,无需AutoCAD、Revit及高额授权费。它采用节点式场景结构,有多种特性,技术栈丰富,分层设计让核心逻辑可复用,性能优化亮点多。
特斯拉开源硬件,中国团队开源大脑!首个具身智能顶配全家桶上线
4月特斯拉宣布人形机器人Optimus技术开放,国内智平方推出全球首个具身智能模型开源社区AlphaBrain Platform,提供全链路技术栈。该平台亮点多,还适配最新具身Benchmark,打破实验室围墙,推动技术突破。
一张图生成「能动」的3D资产:VAST+香港大学AniGen把AIGC推向动画、游戏、仿真与具身智能 (SIGGRAPH 2026 TOG)
SIGGRAPH 2026论文AniGen,由VAST和香港大学研究,能从单张图片直接生成带骨架与蒙皮权重的可动画3D资产。它解决了现有方法的不足,在多方面表现出色,对多个领域意义重大。
MMX-CLI给AI Agent装上七种感官,内容创作更方便
MiniMax发布的MMX - CLI命令行工具,给AI Agent装上七种新感官,具备图像生成、视频创作等能力,可一站式解决内容创作问题。它安装使用简单,功能多,还能集成到现有工作流,不过采用按量付费。
罗振宇、张鹏、王立行等齐聚一堂,AIFUT大会Day1上午场的全面总结来了。
AIFUT大会首日上午,多位嘉宾分享观点。王磊谈亦庄如何拥抱AI;卡兹克称身份被重新定义,好奇心不可被定义;罗振宇认为人最后价值是告诉AI要什么;还有Tim、张鹏、谷大白话、王力行等分享见解。
美团之后,京东也开始自研大模型了
京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。
刚刚,全球首个AI科学家登上Nature!包揽提出idea到写论文全流程,已通过人类盲审
历经一年半研发,Sakana AI联合多高校打造的AI科学家系统登上Nature杂志。该系统能自主完成科研全流程,代码和论文已开源。还介绍了自动审稿人、缩放定律,也指出其局限,引发伦理探讨。