编程基准」共找到 1887 篇相关文章

产品应用7

AI Coding 领域的又一黑马,出现了。

文章介绍了 Vibe Coding 概念走红,提及硅谷合伙人观点。着重介绍 YouWare,其创始人明超平认为 AI 时代需编程分享社区。YouWare 有极简部署、页面优化等功能,虽不完善,但有望成行业黑马。

MacTalk
开源动态7

我去,终于找到原因啦,58.4k Star MemPalace,不敢相信!!!!

AI编程中,上下文压缩后易丢失关键信息。MemPalace将对话和资料按原文存本地,按项目和主题精准找回。本文讲清其存储与检索原理、使用场景、注意事项及安装建议。

小华同学ai
开源动态8

超 2 万人收藏!配一次 MCP,Claude Code 和 Cursor 都能用!这个开源项目火了!

OpenWork是开源AI编程工作区平台,是Claude Cowork开源替代品。它能让不同AI Agent共享技能等,有跨工具工作流共享、可视化审计等亮点,还给出四种快速上手方法。

开源星探
算法论文8

AI 会笑吗?BIGAI & 上交大团队:多模态大模型是否真的能 get 到视频笑点|ACL 2026

上海交通大学等团队构建v-HUB评测基准,分析多模态大模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑点能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论
产品应用8

1段话喊来13个“程序员”,阿里Qoder新模式让我躺着当CTO

作者实测阿里Qoder「专家团模式」,该模式下Qoder组织赛博工程团队,自动解析需求、分配任务,多智能体协同推进项目,解决了代码质量和效率问题,开启多智能体协同编程时代。

量子位
算法论文7

多智能体大语言模型中的人类自适应协作

尽管大语言模型有进展,但纯自治多智能体系统有局限。为此提出 HILA 框架及双环策略优化机制,结合 DLPO 的 HILA 在基准测试中表现出色,为构建 Agentic 系统提供指导。

深度学习自然语言处理
算法论文7

「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习

近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。

机器之心
新闻资讯7

用户集体大逃亡!Cursor“自杀式政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎

很多开发者吐槽和弃用 Cursor,其付费后砍功能、技术变差、营销成“障眼法”,引发信任危机。部分用户转向 Claude Code,AI 编程工具竞争焦点升级,未来有向智能体演进等趋势。

InfoQ
产品应用7

Claude Code发布4个月,用户已经11.5万了,开发者:200 美元/月不算贵

Anthropic的Claude Code发布4个月吸引11.5万开发者,一周处理1.95亿行代码。它集成Claude Opus 4模型,功能实用,口碑好,让开发者觉得物有所值,反映开发者对AI编程工具接受度提升。

机器之心
开源动态8

华为推出软工代码智能体SWE-Lego,解锁SFT训练极致性能

华为研究团队推出仅基于监督微调(SFT)的软件工程代码智能体SWE-Lego,无需复杂RL流程,在SWE-bench Verified基准中表现出色,项目已开源。它有数据、训练和测试时扩展三大创新。

机器之心