「开源编程模型」共找到 9489 篇相关文章
成本仅0.3美元,耗时26分钟!CudaForge:颠覆性低成本CUDA优化框架
CUDA代码性能对模型训练与推理重要,但手动优化门槛高。明尼苏达大学团队提出CudaForge,是低成本多智能体CUDA Kernel生成与优化工作流,实验效果好,成本低且具通用性。
DiT突遭怒喷,谢赛宁淡定回应
扩散模型核心基石DiT遭网友质疑,称其数学和形式有误,甚至怀疑无Transformer。作者谢赛宁回应抨击标题党,强调科学精神与实证方法,还肯定Tread,推荐Lightning DiT版。
使用最新的 Claude 4,我用两天就开发出一个视频编辑器,但却无法维护
作者用Claude 4两天开发出视频编辑器,却难维护。分析原因,指出AI编程在模块级强,但系统层面不足,还列举网友讨论,探讨AI在软件工程各方面的能力及局限。
英伟达,开始限制Claude使用了
本文援引The Information报道,英伟达、Palantir等大企业因对敏感数据控制权的顾虑,限制Anthropic Claude前沿模型用于核心敏感业务,探讨了企业级AI落地的新矛盾与行业发展方向。
GAIR Paper 106|追踪视觉 Token 的演化轨迹,实现无损压缩与 60% 推理加速|CVPR 2026
近年来大视觉语言模型虽推动多模态智能发展,但推理成本高昂。山东大学和MBZUAI团队提出TransPrune,从演化视角衡量视觉Token重要性,保持性能无损同时降低60%推理成本。
Claude Code 工程师:像 Agent 一样思考
Anthropic 工程师 Thariq 分享构建 Claude Code 时 Agent 工具设计经验,通过 AskUserQuestion 工具迭代、Todo List 到 Task 系统演进等案例,指出工具设计无标准答案,要观察模型行为、反复实验。
OpenAI、Anthropic、DeepMind联手发文:现有LLM安全防御不堪一击
OpenAI、Anthropic、Google DeepMind 联手发文,研究语言模型安全防御评估。指出现有防御评估有缺陷,提出通用自适应攻击框架,成功绕过 12 种防御机制,多数攻击成功率超 90%。
深度解读:关于 Jev 的几大疑问
本文针对全网爆火的AI模型Jev,梳理业界不同观点,解读其技术路线、核心特性、能力边界与适用场景,解答大众对Jev的核心疑问,客观分析其真实价值。
逛完WAIC,我们发现这家芯企已经把端侧AI“场景落地”做实
7月17 - 20日,世界人工智能大会召开,端侧AI成热点。瑞芯微展台展示大模型、Agent、AI+应用,多方案已量产落地,其双轨架构优势突出,还规划了产品路线图。
为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告
本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等问题,还会解答观众提问。