「编程性能」共找到 2903 篇相关文章
蚂蚁具身智能明牌了:做大脑,和宇树们错位竞争
蚂蚁灵波开源具身智能基座模型LingBot-VLA,用20000小时真实世界数据训练,解锁最大规模开源真机数据之一。它性能超国际顶尖模型,还指明通用具身智能发展路径,为行业提供全栈解决方案。
AI月产十亿行代码,暴增76%!程序员论坛炸锅:代码行数≠生产力!
Greptile基于每月用AI审核的十亿行代码发布AI编程年度报告,显示AI助力下代码生产量飞涨,但论坛对此多存怀疑,还分析了不同大模型SDK下载量、模型适配场景等,也给出2025年关键论文。
经典ReLU回归!重大缺陷「死亡ReLU问题」已被解决
在深度学习领域,经典 ReLU 函数因简洁性等优势受青睐,但有「死亡 ReLU 问题」。德国吕贝克大学等机构研究者引入 SUGAR 方法,不牺牲 ReLU 优势解决该问题,还设计 B - SiLU、NeLU 函数,实验显示性能提升显著。
半年复盘,AI迎来预训练后的新瓶颈。
2025年上半年AI领域发展加速,编码和多模态能力提升。但模型在综合能力上遇到第二轮瓶颈,编码能力强时通用认知能力‘拉胯’,或与RL阶段使用编程数据有关,红杉新基准或推动模型均衡发展。
Apple 终于承认了:Mac mini 正在变成一台 Agent 服务器
苹果偷摸发布新 Mac mini,处理器升级到 M6 和 M5 Pro,官方将其置于 Agent 常驻使用场景,产品边界向 Agent 服务器延展。新款性能提升显著,Mac Studio 也有强大配置,Apple 产品线朝本地 AI 计算基础设施转变。
击败GPT、Gemini,复旦×创智孵化创业团队「模思智能」,语音模型上新了
近日,由复旦邱锡鹏担任首席科学家的模思智能发布多说话人自动语音识别模型 MOSS - Transcribe - Diarize,性能超 GPT - 4o、Gemini 等。它解决语音领域落地痛点,跑分亮眼,还解决 SATS 方案不足,开放 API 限时免费。
万卡时代,企业需要怎样的算力集群?
过去两年,AI算力需求跃升,消耗从训练主导转向推理驱动。企业算力需求有突发性等特点,智算集群是关键方案。InfoQ联合腾讯云发起直播探讨,还介绍了算力供给缺口、集群构建交付、性能优化及演进方向。
华为盘古首次露出,昇腾原生72B MoE架构,SuperCLUE千亿内模型并列国内第一
当前传统 MoE 有专家激活不均衡问题,华为盘古团队提出 MoGE 解决。基于此架构的盘古 Pro MoE 大模型在昇腾集群高效训练,推理性能强,在 SuperCLUE 榜单千亿内模型并列国内第一,赋能业务落地。
大模型全面爆发,所有榜一都是Gemini!谷歌一夜站到了台前
北京时间今日凌晨,Google I/O 2025 开发者大会开启。谷歌发布或升级系列 AI 工具与服务,如升级 Gemini 模型、推出编程智能体 Jules 等,还展示视频图像生成模型、搜索与购物模式升级,展现其在 AI 应用领域强势回归。
A社你解释下,啥叫Sonnet 5比Fable 5还贵?
Anthropic推出新版性价比模型Sonnet 5,定位为“最能干活”,能力提升但价格暗藏玄机。开发者实测发现,新分词器使Token消耗增加,实际花费可能比Opus还高,且有性能相近但价格更低的替代模型。