代码能力评测」共找到 4821 篇相关文章

算法论文7

Vibe Coding,杀死开源!

Vibe Coding 带来编程效率狂欢,却切断开源生态维护者与用户联系。研究指出,AI 成「中间商」,使开源维护者得不到关注反馈,高质量开源项目或枯竭,作者设想代码版税机制但实施难。

新智元
产品应用7

Qwen2.5VL又多一个娱乐场景,看电影讲故事

文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。

CourseAI
推荐文章7

王云鹤眼中的Harness:复杂优化问题,AGI灵魂争夺之战

王云鹤在知乎文章中探讨Harness Engineering,指出Agent=Model+Harness,多模型配合能提升Agent能力。还分析Harness存在的必要性,认为它是复杂优化问题,关乎AI“灵魂”之争。

机器之心
新闻资讯8

国务院关于深入实施“人工智能+”行动的意见

国务院发布意见深入实施“人工智能+”行动,推动其与各行业领域融合。提出到2027年、2030年和2035年的目标,部署重点行动,强化基础支撑能力,明确组织实施要求。

力学与人工智能
新闻资讯7

连Karpathy都怕了!9千万级AI包被投毒,竟靠黑客写出bug救命

3月24日,AI应用核心工具LiteLLM更新版本含恶意代码,可窃取开发者核心信息。因攻击者代码有bug致机器崩溃才暴露。这引发AI基础设施信任危机,Karpathy称要减少依赖。

新智元
新闻资讯8

硅基生命的「成年礼」:上海具身智能的入世大考与万亿生态突围

2025年,上海具身智能产业发展迅速。政府通过场景开放、算力平权等举措构建生态。智元、傅利叶等企业成果显著。12月12日GDPS大赛是成果检验,各赛道考验机器人不同能力

AI科技评论
产品应用8

刚刚,Thinking Machines出手!首款交互模型来了,翁荔出镜实测

Thinking Machines Lab推出首个大模型TML - Interaction - Small,打破传统人机交互模式,实现全自然交互。它训练范式独特,采用双模型架构等设计,评测表现超GPT - Realtime 2.0等模型,后续还会推出更大尺寸模型。

机器之心
产品应用8

π0引用的中国团队,又出手了:世界仿真器新作发布

Current Robotics团队发布交互式世界仿真器CurrentWorld - 0,创始人祝毅晨履历亮眼。该仿真器能跨本体、多视角、力 - 触觉预测,可用于评测机器人,还能让人类接管以探索不同动作结果。

量子位
开源动态7

MUSA获得SGLang主线支持!5月10日北京,AI Meetup等你来

5月10日北京将举办「SGLang × MUSA」技术沙龙。契机是摩尔线程MUSA后端加入SGLang官方支持体系,代码合入主线,开发者可原生调用摩尔线程GPU。还将探讨框架适配、算子编译等议题。

GiantPandaLLM
新闻资讯7

氛围编程将死!谷歌总监警告:只会写Prompt的程序员,2026年将被淘汰

谷歌云AI总监Addy Osmani称AI编程进入下半场,氛围编程将被取代。AI能提升生产力,但无质量保证,人类专业判断才是关键。他还提出工作模式,强调开发者要结合AI提升能力

新智元