「代码能力评测」共找到 4920 篇相关文章

推荐文章7

扩散架构 or「NoThinking」,AI 对话的「1Hz 壁垒」如何突破?

当红通用人形机器人公司 1X 的 AI 副总裁 Eric Jang 提出「智能频谱」概念,阐述当前 AI 面临的「1Hz 壁垒」及实现「Ultra Instinct」能力的先决条件。不同推理方案有望解决部分问题,但通用智能体仍有瓶颈。

机器之心
产品应用8

4K-Agent:可将低分辨率图像提升至4K高清智能体

图像超分辨率技术在多种视觉任务中重要,但传统方法泛化能力有限。德克萨斯A&M等大学研究人员推出4K Agent,其多智能体架构能将低分辨率图像提至4K高清,在多领域测试表现出色。

AIGC开放社区
产品应用8

5亿融资后清华具身团队首秀:55自由度拿捏360°大旋转,街舞叠衣服都在行,手速堪比电竞选手

这是星动L7机器人秀出的最新能力,打造者是清华叉院背景的星动纪元团队。不久前他们获近5亿新融资,此次新进展惊艳众人,该机器人全身多达55个自由度,创下多项纪录。

量子位
产品应用7

AI编码不是梦:手把手教你指挥Agent开发需求

文章聚焦AI实践应用,以后端开发为例,介绍用AI编码实现需求的流程,涵盖工程结构、各层代码生成等。还分析AI编程问题,提出解决方案,给出生产案例,最后展望AI在研发中的应用前景。

阿里云开发者
算法论文8

美团提出多模态推理新范式:RL+SFT非传统顺序组合突破传统训练瓶颈

美团研究者提出Metis - RISE框架,将RL激励和SFT增强以非传统顺序结合提升多模态大语言模型推理能力。先RL激发潜能,再SFT补齐短板,训练的两模型在OpenCompass榜单成绩优异。

量子位
新闻资讯8

独白:OpenAI前员工的深度反思

OpenAI前员工在博客分享工作体验,从文化、技术等多维度剖析公司。指出极速扩张面临挑战,文化独特,技术上用Python单体代码库、依赖Azure,还详述Codex项目诞生,认为AGI竞赛在OpenAI等三家展开。

AI工程化
开源动态7

Claude Code完整技术栈都被扒出来了,Multi-Agent架构~

analysis_claude_code项目对Claude Code v1.0.33逆向工程分析,含混淆代码技术分析等。发现实时Steering机制、多Agent架构等,为AI agent系统设计实现提供技术参考,还介绍系统架构创新点。

PaperAgent
开源动态8

看遍奥斯卡后,VLM达到电影摄影理解新SOTA|上海AI Lab开源

上海人工智能实验室等推出ShotBench、ShotVL及ShotQA,ShotBench含超3.5k问答对,ShotQA约7万个问答对。ShotVL在ShotBench评测中表现出色,3B参数的ShotVL-3B增益达19.0%,超越GPT - 4o等。

量子位
产品应用7

Claude Code + Kimi K2全栈开发教程,1小时上线「"丑咪"挑战赛」!

作者分享用Cursor + Claude code + Kimi K2开发「丑咪挑战赛」全栈项目的体验,介绍组合优势、接入教程、前端测试案例和使用技巧,认为Kimi K2在agent和coding能力上表现不错,适合作为Coding模型。

花叔
新闻资讯7

马斯克终于成『AI No.1』,6大案例看实力与水分

马斯克发布Grok 4,宣称其超越OpenAI等LLM。它屠了各种榜单,但Grok系列口碑欠佳。文中通过多案例测试,展现其在各方面的表现,如编码、数学、图像等,还提到了API速度和价格。

鲸选AI