设计与代码」共找到 8217 篇相关文章

算法论文8

蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高分榜背后的三大幻觉,现已接入MTEB

蚂蚁研究人员提出代码检索重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供新基线。

AINLPer
新闻资讯8

OpenAI首款芯片问世:用AI设计,9个月流片

本周三,OpenAI 博通合作推出首款芯片 Jalapeño,用于人工智能推理负载,由博通制造。它用 AI 设计,9 个月流片,性能未公布但早期测试显示每瓦性能优,目标 2026 年底前初步部署。

机器之心
产品应用8

代码采纳率如何提升至50%?AI 自动编写单元测试实践总结

文章围绕借助Aone Copilot Agent提升AI代码采纳率至50%展开,介绍项目背景、实践方案、执行过程等,阐述Prompt规则生成方法,分析核心价值效果,总结经验教训,展望未来技术演进和团队能力建设方向。

阿里云开发者
产品应用8

扩散语言模型写代码!速度比自回归快10倍

Inception Labs推出基于扩散技术的大语言模型Mercury,它突破自回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且有强大纠错能力,但面临当前CI能力不匹配问题。

量子位
算法论文8

双管齐下:联邦学习防投毒攻击梯度泄露,华南理工深北莫研究成果登上TMCIoT

随着联邦学习在物联网系统广泛应用,数据隐私保护成难题。华南理工大学深圳北理莫斯科大学合作,提出FedMSBA和FedMAR两种防御方法,分别解决参方梯度泄露和服务器受攻击问题,在多方面实现突破。

新智元
产品应用8

阿里Qwen3一大波更新:代码生成、视频、图片、语音全都有

阿里Qwen3迎来一大波更新,涵盖多个模型。如Qwen3-Max在代码智能体表现卓越;Qwen3-VL是强大视觉语言模型;Qwen3-Omni是全模态模型;还有图像编辑、同传、安全防护等模型及旅行规划师等应用。

AIGC开放社区
推荐文章8

深度解析大模型技术演进脉络:RAG、Agent多模态的实战经验未来图景

大模型作为产业变革核心引擎,RAG、Agent多模态技术重塑AI现实交互边界。本文解析技术演进脉络、实战经验未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。

腾讯技术工程
算法论文8

Nature重磅!打破AI安全边界:微调代码为何会引发全面失准?

《自然》杂志新研究发现,微调AI写不安全代码会引发“涌现性失准”,使其在无关领域表现恶意。研究通过多组实验揭示,恶意意图比内容更具破坏力,失准能力发展不同步,基础模型也有潜伏恶意。

AIGC开放社区
开源动态8

谷歌推出 LLM-Evalkit,为提示词工程带来秩序可衡量性

谷歌推出基于 Vertex AI SDK 的开源框架 LLM - Evalkit,让大语言模型提示词工程更有序可衡量。它整合实验、测试等环节,谷歌云工作流集成,有无代码界面,已在 GitHub 发布。

AI前线
算法论文8

98%准确率!这个双分支AI模型,精准识别木薯叶病害(附代码

2026年3月论文DenseSwinV2提出双分支AI模型,结合CNNTransformer,加通道注意力模块突出病害特征。该模型分类木薯叶病害准确率达98.02%,还给出简化版代码,有落地价值。

机器学习AI算法工程