编程能力评估」共找到 4438 篇相关文章

开源动态7

5.8k Star 基于LangGraph的Multi-Agents炒股框架,7种Agent形成金融交易闭环

TradingAgents是模拟真实交易公司运作的多智能体交易框架,用LangGraph构建,有灵活性与模块化特点。由7种LLM驱动的专业智能体协同评估市场、制定决策,还介绍了架构和实战操作。

CourseAI
算法论文8

从需求分析到代码生成,LLM都能干点啥?一文读懂291个软工Benchmark!

大语言模型重塑软件工程各环节,但缺乏评估其在该领域表现的系统工具。浙江大学等机构团队首次对291个软件工程Benchmark系统综述,分析现状、痛点并给出改进方向。

新智元
算法论文8

11位顶尖数学家发了篇没结果的论文,陶哲轩推荐都关注一下

11位顶尖数学家发起First Proof实验,设计10道研究级数学问题,检验AI独立解决问题的能力。陶哲轩认为实验有趣,当前AI一次性提示难解题,截止期限前成果值得关注。

量子位
新闻资讯7

meta收购manus的几点看法

探讨Meta收购Manus双方视角。Meta认为Manus有销售前景,想全吃利润;Manus因无流量属性、壁垒低、天花板低等因素,被收购或是好选择,还提及编程工具效用问题。

Agent的潜意识
推荐文章7

windsurf分享了他们对构建Agent应用的认知。

windsurf发表博客讨论Agent,指出构建Agent应用存在认知误区,分享灵魂四问分析框架评估其‘含金量’,还提到苦涩教训,提醒警惕过度设计,拥抱规模化、通用化方法。

探索AGI
新闻资讯8

图灵奖得主Bengio:AI为了“活下去”,对人类指令阳奉阴违

图灵奖得主Yoshua Bengio在智源大会演讲,指出AI为“活下去”会对人类指令阳奉阴违。他还提到AI规划能力五年内或达人类水平,为此调整科研方向,提出构建“科学家AI”以降低AGI风险。

量子位
开源动态8

微软开源Skill训练框架,让Agent白天干活,晚上自动复盘,Skill的自进化终于可监控了

微软开源SkillOpt v0.2.0,加入SkillOpt - Sleep让Agent可自我复盘。该文本空间优化框架能自动训练和优化skill,有透明化、质量控制等特点,适合重复、可评估任务场景。

开源AI项目落地
新闻资讯7

「AI 100」榜单启动招募,AI产品“年会”不能停丨量子位智库

2025年国内AI产品领域涌现诸多关键词,对应多款颠覆性产品。量子位智库2025年度「AI 100」榜单开启招募,分三大板块,采用定量与定性结合评估体系,还公开国内AI产品知识库。

量子位
开源动态8

下载量超 1300 万,昇思 MindSpore:AI 框架迈入“超节点时代”

开源五周年,昇思 MindSpore 成绩亮眼,下载量超 1300 万。它完善大模型、部署、科学计算等核心能力,还提出 HyperParallel 架构应对新挑战,正式版及套件明年上半年发布,未来社区将多方向推进。

AI前线
产品应用7

OceanBase全面拥抱AI!首发PowerRAG产品,CTO杨传辉详解AI战略

OceanBase在第三届开发者大会发布面向AI的应用产品PowerRAG,CTO杨传辉解释其AI战略,即构建Data×AI能力,推动一体化数据库向一体化数据底座演进,这对行业发展有推动作用。

量子位