「存在论」共找到 8212 篇相关文章
登上NeurIPS,Genesis开创无需OCC引导的多模态生成新范式,在视频与激光雷达指标上达到SOTA水平
华中科技大学与小米汽车提出多模态图像 - 点云联合生成框架Genesis,采用两阶段架构和DataCrafter模块。在nuScenes数据集实验显示,其在视频与激光雷达指标达SOTA水平,还提升了下游感知任务效果。
马斯克发布“地球最强AI模型”Grok 4:横扫所有榜单,在“人类最终测试”超越人类博士”!
北京时间7月10日,马斯克团队发布Grok 4,其基准测试成绩惊人,在‘人类最终测试’等表现出色。它成功源于多智能体协作、追求真相哲学和高算力投入,还在多领域展现应用潜力,同时公布定价并坦言短板。
在腾讯、育碧的做过游戏后,他转身做 AI 原生游戏,一上线就好评如潮
AI 原生游戏「动物去哪儿」基于真实地理数据,让玩家的小动物开启真实旅行,经历随机事件。创始人太一曾在腾讯、育碧任职,受 AI 启发制作此游戏。目前游戏在观猹获 9.1 分,本周五将邀太一直播答疑。
GUI定位还在玩「非黑即白」?浙大团队提出GUI-G²,显著提升GUI智能体定位性能
在人工智能领域,GUI 智能体成技术风口,但现有 GUI Grounding 方法有缺陷。浙大团队提出 GUI - G²,将 GUI 交互转变为连续空间建模,在三个主流 GUI 定位基准测试中表现亮眼,重新定义了 GUI 交互本质。
非Transformer架构落地之王,带着离线智能和原生记忆能力在上海WAIC浮出水面
在上海WAIC现场,RockAI展台的机器狗和灵巧手在离线状态表现出色,背后是其非Transformer架构的大模型Yan 2.0 Preview,有原生记忆和离线智能能力。该公司成立两年,押注此架构,产品已商业落地,还构想群体智能未来。
顶级工程师Karpathy的“AI革命”:一个月前还在焦虑“落后”,如今“20年古法编程习惯”被彻底颠覆,80%代码已交给AI!
顶级工程师Andrej Karpathy分享用Claude编程心得,称过去20年编程方式在几周内改变,12月约80%代码交agent,自己做20%修改。Claude和Codex在2025年12月跨过‘一致性/连贯性门槛’,让agent编程可行。
GPT-5 在 Lovable/Vibecode 中氛围编码,附 GLM-4.5 对比 (反向搜索引擎、吵架的俄罗斯方块)
文章展示GPT - 5在网页端、Lovable、Vibecode的测试案例,与GLM - 4.5对比。如GPT - 5在WebDev Arena创纪录,不同版本使用限制不同。还列举多个应用案例,指出GPT - 5有不足,GLM4.5全栈开发表现不错。
都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了
一项新研究表明,7B小模型LoopCoder v2在正常计算外多循环一次,就能在SWE - bench Verified基准上大幅提分。继续增加循环次数,性能反而下降。研究还算了‘收益 - 成本’账,给出选择循环次数的诊断方法。
【栏目对话和访谈】Sebastian 和 Nathan 在 Lex Fridman 播客深度解读 AI 现状:中美竞争、模型对比、规模定律、AGI 时间线
Sebastian 和 Nathan 在 Lex Fridman 播客中,用 4 小时深度解读 AI 现状,涵盖中美竞争、模型对比、规模定律、AGI 时间线等热门话题,还分享了入行建议、工作文化等多方面观点。
推理token减少46%!Meta新方法缩短思维链,告别重复推导
Meta等联合提出元认知复用机制,让模型总结解题思路,提炼为“行为”存于“行为手册”。实验显示,该机制在数学基准测试中显著优化,保持准确率时最多减少46%推理token使用量。