「自改进闭环」共找到 1734 篇相关文章

开源动态8

清华发布世界模型评测新标尺:直击机器人感知与行动鸿沟

清华大学等机构推出 WorldArena 评测基准,用于测试 EWM 真实能力。它融合感知与功能评估,含十六项视频指标,结合主客观评价生成 EWMScore。测试揭示模型在感知与行动上的差距,转型为实用型模型是行业挑战。

AIGC开放社区
产品应用8

让问题不过夜:交易领域“问诊”Agent实践

文章针对研发支持中的痛点,构建智能Agent系统,将问题抽象为业务答疑与问题诊断两类能力。介绍了系统架构、构建演进、知识体系、质量评估等内容,还展示实战成效,指出当前边界与下一步方向。

阿里云开发者
推荐文章8

大模型Agent的核心还是prompt? 目前有什么挑战?

文章指出大模型Agent核心并非Prompt,而是工程化架构设计、工作流编排与数据闭环。介绍Flow Engineering等概念及工具,分析规划、记忆、工具使用要点,还谈及开发面临的延迟、稳定等挑战,并给出应对建议。

深度学习自然语言处理
产品应用7

更新啦!我用 Claude Skills 做的剪辑 Agent!识别效果+交互大升级

作者成峰根据用户反馈对剪辑 Skills 做了大改,替换火山引擎音视频识别模型、提升交互界面。改进包括用 API 替代本地模型、重构口误识别系统、设可视化审核界面,还介绍了简单使用方法。

AI产品自由
新闻资讯8

顶级工程师Karpathy的“AI革命”:一个月前还在焦虑“落后”,如今“20年古法编程习惯”被彻底颠覆,80%代码已交给AI!

顶级工程师Andrej Karpathy分享用Claude编程心得,称过去20年编程方式在几周内改变,12月约80%代码交agent,自己做20%修改。Claude和Codex在2025年12月跨过‘一致性/连贯性门槛’,让agent编程可行。

InfoQ
算法论文8

从平面几何出发:形式化验证如何驱动MLLM的推理能力跃迁

多模态大语言模型在复杂数学与几何推理中有缺陷,现有训练方式让模型难有鲁棒推理能力。上海交大等团队提出“以形式化增强非形式化推理”方案,构建完整闭环,提升模型推理及泛化能力。

机器之心
新闻资讯7

中国芯片迎来关键一战

自2020年华为麒麟芯片断供,中国芯片加速自主研发,2025年末集体冲刺上市。如摩尔线程、沐曦股份等,虽多数亏损,但市值狂飙。不过,国产GPU面临技术、生态等挑战,崛起需漫长蛰伏与突破。

芯师爷
新闻资讯8

Agent交卷时刻:企业如何跨越“一把手工程”信任关?|甲子引力

在2025甲子引力年终盛典中,甲子光年智库院长宋涛对话五位AI企业负责人,探讨AI Agent在企业中的价值与落地问题。嘉宾们认为AI Agent可降本增效、推动转型,但落地面临信任、成本等阻力,需深入业务创造价值。

甲子光年
7

AI修真的一年:学者们怎么看“真智能”?|甲子光年

甲子光年在年终盛典对话三位学者,探讨AI“真假智能”。学者们提及强化学习、推理、多模态等技术突破,分析研究路径,还谈选择标准与未来期待,指出AI是工程实践命题,真与假关乎信念选择。

甲子光年
新闻资讯8

Khosla 继 OpenAI 后的最大赌注,General Intuition 凭 38 亿个游戏高光片段做世界模型

今年10月,General Intuition完成1.34亿美元种子轮融资,由Vinod Khosla领投。它从Medal分拆,有38亿游戏短视频片段,可赋予机器“直觉和物理常识”,与LLM互补,商业化将从游戏拓展到物理世界。

海外独角兽