按结果付费」共找到 916 篇相关文章

推荐文章8

11篇顶会论文之外,美图影像研究院做了一件事:让大众爱用AI

过去两年,AI 生成图片、视频变得容易,但让 AI 理解并创作者意图创作很难。美图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。

机器之心
产品应用7

OpenCode AI编程实践:利用推理路由低成本开发游戏

文章介绍用 OpenCode 结合 DigitalOcean 推理路由器开发点球大战游戏 PK Shootout。其任务选模型,多数任务路由到 MiMo V2.5 和 GLM - 5.2,成本约 8.25 美元,远低于只用前沿模型。文中还分析开发各环节及适用场景。

AI工程化
算法论文8

Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型

文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。

机器学习AI算法工程
产品应用8

「双线实测」Qwen 3.6-Plus,Agentic Coding 已经这么能“扛活儿”了?

4月7日阿里云通义千问Qwen3.6-Plus上线,作者用两套真实复杂任务评估其智能体能力。结果显示它在复杂决策和编码任务表现出色,有工业级交付水准,但也有首字延迟等短板,且参数效率优势明显。

AI科技评论
算法论文8

EMNLP25 | 北大x腾讯光子发布 C3 Benchmark:中英双语语音对话模型“地狱级”测试基准,直击语音对话模型软肋!

近年来语音对话模型受关注,但处理人类对话复杂现象的效能缺乏研究。北大联合腾讯光子构建中英双语C3 Benchmark数据集,评估模型应对复杂对话的能力,结果揭示性能瓶颈,为模型优化提供参考,代码和数据已开源。

深度学习自然语言处理
产品应用7

不吹不黑,GPT-5代码能力究竟怎么样?跟 Gemini 和 Claude 的对比测试给你答案

作者测试了 GPT-5 的代码能力,并与 Gemini 和 Claude 对比。在不同代码任务中,各模型表现不同。如在生成网页任务里,GPT-5 部分结果不错,但受 32K 上下文限制,长文本处理不如 Gemini,硬实力也不如 Claude。

歸藏的AI工具箱
推荐文章3

16 个月、45 万资金投入,一款 AI 社交产品的创业失败复盘

作者复盘AI社交产品“抱抱窝”创业失败经历,涉及方向选择、团队搭建、时间资金把控、团队沟通等问题,还给出经验建议,如选方向要有标准,团队开发股份占比应合理,明确时间表等。

Founder Park
推荐文章7

【博客转载】CUDA Reduction

文章来自Lei Mao,介绍CUDA归约操作。先阐述归约操作在并行计算中的常见性,接着实现两个批量归约求和kernel,还给出构建和运行示例的命令及结果。最后探讨大数组归约求和的方法及性能影响。

GiantPandaLLM
产品应用7

AI 编码圈新卷王 Magic Path 来了,Claude Engineer 团队出品,号称UI设计的 Cursor 时刻。

Magic Path是Claude Engineer团队推出的AI驱动UI设计工具,非开源但有免费额度。它AI先行,能提示词生成组件和React代码,亮点诸多,上手体验佳,生成UI可用,还有页面串联等功能,虽有不足但潜力大。

AI进修生
算法论文7

SOTA大模型遇上加密数据评测:Qwen3未破10%,o1也栽了丨上海AI Lab等联合研究

当前推理模型在基准测试中性能卓越,但在密码学领域推理能力待探索。上海AI Lab等推出CipherBank评测,用海量真实隐私场景数据和多类型密码算法挑战SOTA大模型,结果显示模型表现不佳,还分析了模型“犯难”原因。

量子位