「代码能力」共找到 4456 篇相关文章
Code2Video:全新AI教学视频生成框架,助力高质量教学
生成式模型在生成专业教育视频时受限,新加坡国立大学Show Lab提出Code2Video框架,以代码为中心,由三个协作智能体组成,能通过Python代码自动生成高质量教育视频,代码驱动生成优势明显。
Claude Code、Cursor 可能都躲不过一次“大重写”,但 OpenCode 也许是例外
文章指出Claude Code、Cursor等AI编程工具因开发方式问题,代码库陷入难逆转状态,或迎“大规模重写潮”。而OpenCode强调代码一致性,代码库更干净。其创始人分享开发经验、工作流及对行业现象的看法。
AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河
在 AICon 大会上,IDEA 研究院张磊剖析多模态智能体发展难题,提出从“半结构化”场景切入的落地路径,分享工业界研究与产品平衡见解,还为年轻人在 AI 浪潮中发展给出建议。
模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相
近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。
震撼全网,AlphaEvolve矩阵乘法突破被证明为真!开发者用代码证实
开发者用Claude写代码证实谷歌DeepMind的AlphaEvolve求解矩阵乘法的突破为真,它将4×4复数矩阵计算次数从49次减到48次。小哥测试代码各项指标与论文报告一致,还上传到GitHub。
基于浏览器请求录制与AI代码生成的E2E接口自动化测试实践
文章以阿里云DataWorks为例,介绍通过浏览器录制插件捕获请求数据,结合AI编程工具生成接口封装与测试用例,解决复杂平台自动化测试难题,对比传统与新范式,剖析新范式优势、协作机制等。
4B模型幻觉抑制能力超越GPT-5,CMU等提出行为校准强化学习新方法
大语言模型幻觉问题是部署难题,CMU等研究人员提出行为校准强化学习新方法,重新设计奖励函数。经训练,40亿参数模型幻觉抑制力超GPT - 5,实验证明该方法效果显著,还带来理论洞察。
GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%
最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。
最强编码模型Claude 4来了!Mcp集成无需Client,扩展提示缓存增强Agent长上下文保持能力
Anthropic 昨日推出新一代 Claude 模型,包括 Claude Opus 4 和 Claude Sonnet 4,在编码、高级推理和 AI Agent 方面树立新标准,有卓越编码能力、显著提升的 Agent 能力、全新 API 功能,Claude Code 也全面上市。
只会写代码没戏了!奥特曼最新面试题曝光:1人要干1个团队的活
OpenAI开年首场答疑会,奥特曼坐镇回应关切。他承认团队为追求ChatGPT编程能力,牺牲创意协作能力。还谈及软件工程未来变革、AI成本降低、Agent自主运行等问题,也对众多提问给出看法。