「地理时间理解」共找到 1143 篇相关文章
震惊!如果AI掌控核按钮,95%的情况它会按下去
伦敦国王学院研究者让GPT - 5.2、Claude Sonnet 4和Gemini 3 Flash三款模型模拟核危机博弈。不同时间框架下模型表现不同,还展现复杂战略推理能力,95%对局用了战术核武,暴露诸多问题。
Bengio 15 年前论文再夺 AAAI 奖!AI 正告别单纯炫技,走向真实世界
全球人工智能顶会AAAI揭晓年度奖项,Yoshua Bengio 2011年论文获经典论文奖。今年5篇杰出论文研究方向指向AI从炫技走向应用,如ReconVLA改进VLA视觉感知,CADYT解决连续时间因果结构学习空白等。
别焦虑!不会用AI也不会被淘汰,工程师老哥实测各类工具:10倍生产力神话太夸张了
工程师科尔顿·沃奇实测Claude Code等AI开发工具后发现诸多问题,如难以理解大型代码库上下文、跟不上标准等。他认为‘10倍生产力’是神话,AI需工程师引导,大家不必因AI而焦虑。
英伟达发现RL Scaling!创造力暴涨,做基座模型做不了的事!
过去学界争论强化学习(RL)对语言模型的作用,此前研究认为其效果有限。本文发现问题出在训练时间短,提出ProRL,让训练突破2000步以上,结果惊人,小模型也能有出色表现。
不装了!LeCun哈萨比斯神仙吵架,马斯克也站队了
图灵奖得主Yann LeCun与诺贝尔奖得主、谷歌DeepMind CEO哈萨比斯就“智能的本质”展开激辩,马斯克站队哈萨比斯。二人观点分歧大,后LeCun称主要是用词分歧,双方都关注世界模型,但理解和实践有别。
我觉得“Agent”这个词,现在终于有了一个大家都认可的定义了
作者Simon Willison认为现在‘Agent’有了大家认可的定义,即一个AI Agent是为实现目标循环调用工具的大语言模型。还分析了此前难统一定义的情况、‘工具循环实现目标’含义,指出不同人群对‘Agent’理解有偏差。
Karpathy的软件3.0:Agent的原生世界
OpenAI联合创始人Andrej Karpathy在Sequoia Ascent大会上表示,AI Agent正改变软件与工作模式。编程基本单位从写代码变为给Agent下达指令,软件3.0以上下文窗口为程序,LLM为解释器。他还提出理解AI能力分布的框架,给出创业建议。
将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式
快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。
“没有AI味”的Flux.1新模型,现可以免费试用
全新AI生图模型FLUX.1 Krea [dev]发布,可在Krea Edit免费试用。官方称其“没有AI感,只有自然细节”。实测它在光影和自然细节表现不错,但对形象、时空结构理解待提升,还存在额度使用问题。
告别AI“乱画图表”!港中文团队发布首个结构化图像生成编辑系统
现有AI生图工具在结构化图像生成上问题多,理解与生成能力有鸿沟。港中文等校联合团队提出首个综合性方案,涵盖数据集构建、模型优化、评估基准三大模块,助多模态模型画准图,推动其发展。