编程竞赛基准」共找到 2037 篇相关文章

算法论文7

Vibe Coding,杀死开源!

Vibe Coding 带来编程效率狂欢,却切断开源生态维护者与用户联系。研究指出,AI 成「中间商」,使开源维护者得不到关注反馈,高质量开源项目或枯竭,作者设想代码版税机制但实施难。

新智元
产品应用7

使用最新的 Claude 4,我用两天就开发出一个视频编辑器,但却无法维护

作者用Claude 4两天开发出视频编辑器,却难维护。分析原因,指出AI编程在模块级强,但系统层面不足,还列举网友讨论,探讨AI在软件工程各方面的能力及局限。

宝玉AI
开源动态8

手机上同步用 Claude Code 和 Codex,666啊~

开发者常遇AI编程任务运行时需离开电脑的困扰。开源项目`Happy`是Claude Code和Codex的移动端及Web客户端解决方案,有跨端控制、实时同步等功能,助开发者随时随地管理会话。

开源先锋
新闻资讯7

刚刚,Anthropic 又出新货:Claude Opus 4.1 发布,代码、推理能力再升级

Anthropic发布Claude Opus 4.1,是对Opus 4的小升级,提升智能体任务、代码处理和推理能力。付费Claude用户等已可用,价格不变。在编程评测表现佳,获多方好评,官方建议升级。

AI进修生
新闻资讯8

MMLab@HKU 闪耀 CVPR 2025!与全球顶尖学者共话 AI 前沿

CVPR 2025 于 6 月 11 日至 15 日在美国纳什维尔举行,MMLab@HKU 携 24 篇高质量论文亮相。其还是三项国际竞赛的发起与主办方,主办六项前沿活动,研究成果展示了多领域进步。

AI科技评论
开源动态8

这个开源PDF解析器,拿了全球第一

OpenDataLoader在主流PDF解析器基准测试中排第一,尤其是表格提取准确率高。它功能丰富,有本地和混合两种模式,还将推出免费自动标记功能,支持与LangChain集成。

GitHubStore
新闻资讯7

meta收购manus的几点看法

探讨Meta收购Manus双方视角。Meta认为Manus有销售前景,想全吃利润;Manus因无流量属性、壁垒低、天花板低等因素,被收购或是好选择,还提及编程工具效用问题。

Agent的潜意识
算法论文8

攻克长文档与多模态挑战,Paper2Video实现学术视频的自动化生产

新加坡国立大学 Show Lab 团队主导研究,提出 Paper2Video 基准及评价指标,还推出 PaperTalker 多智体框架实现学术视频自动化生产,实验显示其在多方面表现佳,效果接近人工水平。

机器之心
开源动态7

OpenClaw引爆的AI Agent浪潮中,终于有芯片给端侧“解渴”了

OpenClaw让AI Agent成产业竞赛焦点,但云端方案算力、成本和安全问题凸显。瑞芯微推出端云协同方案ClawChips,采用算力解耦架构,在成本与场景适配间找平衡,还开源并提供开发套件借用权益。

芯师爷
算法论文8

AI 如何讲好一个多人故事?首个支持多角色互动的3D场景叙事系统

首尔国立大学提出全新框架,能生成虚拟动态场景并支持多角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性和实用性。

带你学AI