代码执行模拟」共找到 2305 篇相关文章

开源动态8

机器人长出800个心眼?阿里达摩院开源具身新大脑,硅谷又坐不住了

2026年具身智能竞争激烈,阿里达摩院开源RynnBrain“具身大脑”。它采用分层架构,在16项评测中超越前沿模型。还介绍了核心技术、训练策略等,且全系列模型、评测基准和代码均开源。

新智元
新闻资讯8

凯捷研究院最新报告:到2028年,Agentic AI市场规模4500亿美元

凯捷研究院报告显示,到2028年Agentic AI有望撬动4500亿美元经济价值,但目前仅2%企业规模化应用。其能自主执行任务,带来商业价值,不过面临信任危机,各行业巨头已开始探索落地场景。

AIGC开放社区
算法论文8

机器人需求驱动导航新SOTA,成功率提升15%!浙大&vivo联手打造

浙江大学和vivo人工智能实验室团队在ACM MM 2025发表新框架CogDDN。它模拟人类认知,将“双过程理论”用于机器人需求驱动导航,实验中表现优于单视角SOTA方法,为智能机器人技术发展奠基。

量子位
产品应用8

单张显卡跑出15倍推理速度,aiX-apply-4B小模型加速企业AI研发落地

3月25日,硅心科技发布专为代码变更应用场景设计的轻量级模型aiX - apply - 4B。该模型在准确率、推理速度等方面表现出色,超越部分千亿级大模型,还推出“大模型+小模型”协同架构释放企业算力价值。

量子位
新闻资讯8

比肩OpenAI Simple Codex,中国团队闯入Terminal-Bench全球第二!

Anthropic和OpenAI推出新模型后,基础大模型较量进入实战比拼。中国团队Feeling AI的CodeBrain - 1在Terminal - Bench 2.0榜单排全球第二,它聚焦代码编写运行,还能动态调整计划策略,展现出高含金量。

机器之心
开源动态7

Vercel 开源 Bash 工具:基于本地文件系统的上下文检索

Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。

InfoQ
新闻资讯8

红色警报:OpenAI的Atlas浏览器,是捅向谷歌万亿心脏的匕首吗?

OpenAI推出ChatGPT Atlas浏览器,争夺全球互联网入口,直指谷歌核心业务命脉。谷歌核心收入源于搜索广告,Chrome是确保流量的关键。而Atlas以‘回答’和‘执行’为核心,或让谷歌广告竞价系统失效,谷歌必将强力反击。

新智元
产品应用7

GLM4.5实测:审美不如R1,全栈还不大可用,别急冲

7月29日智谱开源GLM - 4.5。作者实测发现其在UI设计审美不如R1,生成卡片表现不一,Coding能力勉强及格,全栈代码生成未达可用阈值,存在无多模态能力、上下文窗口短等问题,目前还别急着冲。

AI产品黄叔
推荐文章7

OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取任务,而图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态大模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码

PaperAgent
产品应用7

Cursor Origin 上线,GitHub 的老玩法还够用吗?

8月17日,GitHub服务异常,同日Cursor向付费计划开放Origin early beta。代码仓库接入更多Agent,现有设施适应人的节奏,而Agent工作节奏更快。Origin重写协作成本,与GitHub设计前提有差异,马斯克布局延伸到软件生产链。

AI科技评论