「编程能力」共找到 3953 篇相关文章
博士宿舍激情脑暴,革新了Scaling Law?Qwen和浙大联手推出新定律,直接干掉95.5%推理内存!
近日,阿里与浙大合作提出并行计算缩放定律 ParScale,可在不增参数下提升大模型能力,推理效率更高。它通过引入并行流实现,在数学、编程等任务表现佳,适合边缘设备,代码已开源。
给Cursor、Claude Code装上这个CLI,能变现
teamai-cli 是腾讯开源的命令行工具,能集中管理团队调教 AI 编程助手的成果,同步给全团队。它复用软件工程方法,解决 AI 协作中经验不沉淀、行为不一致等问题,让 AI 能力从个人资产变为团队资产。
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
谷歌新版Gemini一夜端掉UI:单HTML文件复刻macOS,成功率100%
谷歌新版Gemini 3.0 Pro能力惊人,几行提示词就能在浏览器复刻苹果macOS,还能生成网页版Windows、Linux,功能完整且能一次生成,代码已公开。不过有网友指出这只是模拟环境。业内推测其或在未来几个月发布。
OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!
半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。
数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~
Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。
OpenAI重回巅峰:GPT‑5.5全球SOTA,碾压Opus 4.7
OpenAI发布GPT - 5.5,定位为‘为真实工作而生的新一代智能’。它在编码、科研、办公等多领域表现出色,能力重心转向‘自主完成任务’,在多项评估中成绩优异,还能加速生物医学研究,且Token效率大幅提升。
GPT-5来了!人人都能免费用,最强大模型只需最傻瓜式使用
全世界等了2年,GPT - 5正式发布,面向所有人免费开放。它在AIME 2025取得优异成绩,编程等方面全面提升,集成多模态和推理能力,还推出多种使用模式和API模型,不过也遭马斯克等质疑。
SDD 如何在复杂业务系统中真正落地?
文章围绕SDD在复杂业务系统落地展开,介绍OpenSpec库使用,对比与系分差异,分析其优势与问题,如LLM与IDE执行能力鸿沟、无update命令等,还对比OpenSpec和GitHub Spec Kit,并给出流程及提示词。
吴恩达:一边是CS毕业生“过剩”,一边是AI人才抢破头,问题出在哪?「cs专业依然是王牌」
吴恩达分享对CS专业人才市场的观察,指出市场对AI开发者需求未满足,而新毕业CS学生失业率上升。根源是高校课程未跟上AI提升编程生产力的步伐,还阐述了AI工程师核心能力及人才短缺趋势等。