「大模型应用开发」共找到 9808 篇相关文章

研究资讯7

AI生成苹果Metal内核,PyTorch推理速度提升87%

Gimlet Labs研究显示,AI能自动生成苹果芯片Metal内核,使PyTorch推理速度提升87%,在215个PyTorch模块上平均加速1.87倍。多个模型组合生成最优内核概率更高,不过研究对比方式遭质疑。

量子位
算法论文8

EMNLP 2025 | 动态压缩CoT推理新方法LightThinker来了

随着AI发展,大语言模型处理复杂推理任务能力提升,但推理产生大量中间步骤和文本,拖慢计算速度、增加资源压力。研究者提出LightThinker,模仿人类思考模式,动态压缩推理步骤,削减tokens数量,降低成本。

机器之心
产品应用7

从需求到研发全自动:如何基于Multi-Agent架构打造AI前端工程师

本文介绍蚂蚁消金前端团队打造的Multi - Agent智能体平台“天工万象”。阐述其技术实践,对比多Agent与统一型Agent、ReAct范式与固定工作流优劣,还介绍专业智能体建设,分享开发中的思考与经验。

阿里云开发者
推荐文章7

一文看懂英伟达的产品体系和命名规则

文章由小枣君撰写,详细梳理英伟达产品体系和命名规则,涵盖算力芯片、超级芯片、超级计算机平台等,介绍各层级产品特性,还提及通信技术、开发框架CUDA,助读者清晰了解英伟达产品。

芯师爷
新闻资讯7

Fable 5开始灰度解禁?6月26日大限倒计时

被禁用多日的Fable 5疑似开始部分解禁,在少部分用户的Claude手机App中出现,代码更新也释放其将整合进Claude订阅服务的信号。同时,Claude Sonnet 5可能落地,且旧版Sonnet使用限制取消。6月26日美国商务部需对大模型访问权限答复。

新智元
开源动态8

AGI新技术路线:下一代稀疏注意力机制Monte Carlo Attention开源

超对称技术公司开源了 Monte Carlo 注意力机制,用于新版基座模型 BigBang - Proton。它在二进制块编码技术上,用块间代表交流机制实现线性复杂度,解决了传统方法的缺点,可实现理论上无限的上下文长度,对现有预训练技术和硬件设计影响深远。

InfoQ
新闻资讯7

100亿美元!AI时代最闷声发财的两家公司,要合并了

《华尔街日报》报道,支付公司Stripe正与AI初创公司OpenRouter谈判收购事宜,价格达100亿美元。OpenRouter是全球规模最大的AI模型聚合平台,Stripe为科技公司提供底层金融服务。此次收购将扩展Stripe业务至AI生态。

机器之心
算法论文8

重写手机AI安全边界!首个MoAI攻防SoK,系统梳理三大安全支柱

墨尔本大学等联合发布论文指出,移动端AI硬件和模型发展使MoAI成重要范式,但带来安全风险。论文给出统一框架,拆解系统为四层,定义三大安全支柱,梳理攻击、防御图谱等,还提出开放问题与未来方向。

新智元
产品应用7

DeepSeek识图模式全量上线,却认不出自家老板梁文锋

端午节前,DeepSeek全量推送识图模式。测试发现,它能认出黄仁勋,但忽略‘豆汁’字样,识别人物和潦草汉字准确率低,不过识别文物能力不错。还比较了与其他模型在乐理推理测试中的表现,开发者有新疑问待解答。

机器之心
产品应用8

全球AI双榜第一!力压谷歌Veo与Grok,Vidu Q3「参考生」之王归来

这个月初谷歌免费开放Veo 3.1视频生成能力,让AI视频更普及,但模型距‘能交付’仍有差距。Vidu Q3带着‘全家桶’回归,覆盖多领域,在权威评测榜单成绩优异,视觉、听觉和场景能力升级。

新智元