「代码生成模型」共找到 9604 篇相关文章
预测下一个像素还需要几年?谷歌:五年够了
谷歌DeepMind研究者分析下一像素预测在图像识别与生成任务中的扩展特性。实验显示其扩展趋势与文本类似但效率低,最优策略因任务和分辨率而异,预计未来五年逐像素建模可行。
4K超分Agent修图师来了!一键救活所有模糊照片
传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于多智能体设计,有感知、复原等模块,能为图像定制4K超分方案,在多领域测试中表现出色,无需特定领域再训练。
大厂CIO独家分享:AI如何重塑开发者未来十年
阿里云智能集团副总裁、CIO 蒋林泉分享 AI 时代开发者竞争力构建。探讨技术贡献衡量、全栈工程师发展、产研与业务提效顺序、知识协作及大厂招人要求等,指出 AI 助发现并解决软件工程问题。
6款小游戏难倒所有顶级VLM!愤怒的小鸟让它们全军覆没,性能不如随机猜测
淘天集团未来生活实验室提出首个系统性评估多模态大模型(VLM)交互式物理推理能力的综合基准DeepPHY。它集成六个物理环境,对17个主流VLM测试,揭示其在物理交互等方面短板。
医疗AI质变时刻来临!国产医疗AI率先突破,临床诊疗能力问鼎全球
文章指出当前医疗AI真实能力与临床期待有落差,为此中国医生联合制定全球首个评估医疗AI临床适用性标准,完成对主流模型测评,中国企业打造的MedGPT夺冠,还推出‘未来医生’平台服务患者。
3A大作!阿里ROLL团队从基建->算法->机理,推动RL4LLM全栈协同优化
阿里巴巴ROLL团队联合高校推出「3A」协同优化框架,推动「强化学习用于大语言模型(RL4LLM)」迈向新范式。Async架构提升GPU利用率,AsyPPO降低计算资源消耗,Attention机制提升训练效率与可解释性。
谷歌Gemini闹乌龙:我家狗子,竟被AI开除了「狗籍」!
2025年10月谷歌让Gemini for Home接管智能家居生态。它能识别人脸、快递等,还会生成家庭日报。不过,它也闹了把狗认成猫的乌龙。谷歌正改进识别准确度,这也是智能家居竞争中的小插曲。
AI 浏览器压根不可能成为新的操作系统
近期AI浏览器成大模型主战场,营销中模糊Browser和OS边界。文章指出‘AI Browser = OS’不成立,分析原因,还提出定义为Agent操作层更合适,未来或走向能力优先、标准互通的‘通用容器’模式。
突发!arXiv CS新规:未经同行评审,一律不收
arXiv CS板块新规,「综述/调研」和「立场」类论文须经同行评审才可收录。因LLM生成论文激增,此类无实质价值论文增多。但学界大佬对此不满,认为会误杀优质内容,拖慢成果发布。
理解规范驱动开发:Kiro、spec-kit和Tessl
作者尝试理解规范驱动开发(SDD),查看了 Kiro、spec - kit 和 Tessl 三个自称 SDD 的工具。介绍了 SDD 定义、规范含义,分析评估工具的挑战,还指出工具存在不适合多数编程问题、审查体验差等问题。