代码能力评测」共找到 4860 篇相关文章

算法论文8

一篇大模型Agentic框架到应用最新综述

这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测

PaperAgent
新闻资讯8

哇塞,今天北京被机器人人人人人塞满了!

世界机器人大会在北京开幕,100多个新机器人亮相。智平方的爱宝机器人人气爆棚,它能用一个基座模型完成多任务。其搭载的GOVLA大模型有四大核心能力,且已在多行业商业化落地。

量子位
算法论文8

LeCun团队揭示LLM语义压缩本质:极致统计压缩牺牲细节

图灵奖得主LeCun团队提出全新信息论框架,对比人类与LLM语义压缩策略。通过构建人类概念分类基准、选30+LLMs,发现LLM虽有语义组织能力,但难处理细粒度差异,侧重统计压缩,人类更重细节语境。

量子位
产品应用8

从 “可用” 迈向 “好用”:详解火山引擎智能视频云的三层架构升级|甲子光年

2025年AI关键在多媒体领域,智能多媒体落地有变革也面临挑战。火山引擎提出智能视频云三层架构升级,即基建、平台、应用层升级,助企业实现低成本、高效率规模化应用,多行业已基于此打造能力

甲子光年
算法论文8

DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角

DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。

AI寒武纪
新闻资讯7

卡帕西都整破防了:AI Coding没门槛,可部署环节真嗯啊的难

AI Coding界明星卡帕西公开吐槽,代码不再是AI编程瓶颈,部署才是。他以自己开发「菜单图片生成器」的经历为例,指出部署环节问题频发。他认为应让AI调用和配置,还推荐了Stripe Projects等优化产品。

量子位
产品应用9

『书生·端砚』全面开放全栈服务,“算、证、验”三合一,筑牢科学智能底座 | 2026浦江创新论坛

上海人工智能实验室在2026第十九届浦江创新论坛上,升级发布书生·端砚科学发现平台并全面开放全栈服务,升级三大核心能力,覆盖完整科研流程,已落地六大核心科研领域,开放给科研人员试用。

OpenMMLab
开源动态8

牛B, 我真的起飞啦,6.4k Star Bright Data CLI~~~~

约6.4k Star的Bright Data CLI想解决AI Agent访问网页难题,把网页变成易被模型读懂的材料。它将网页访问能力拆成终端可组合动作,还关注工程化细节,让Agent上网有章可循。

小华同学ai
算法论文8

全球首个,连续时间具身世界模型!任意帧率自由生成

来自清华AIR与UC Berkeley BAIR的团队提出全球首个连续时间具身世界模型ODEWorld。它学习世界在每个时刻的变化方向与速度,能任意帧率自由生成,统一了离散模型分散的生成能力

新智元
新闻资讯7

太反差了!那边Claude强制「刷脸」认证,这边国内Coding Plan被外国人疯抢

Anthropic要求Claude用户进行严格身份验证,被网友吐槽。而国产GLM Coding Plan因模型能力提升在海外走红,海外版涨价后,海外开发者研究买中国版,国内购买也很火爆,闲鱼还出现代抢生意。

机器之心