新模型Spud」共找到 9430 篇相关文章

新闻资讯7

The Batch: 941|盲人辅助模型中的隐患

视障患者用AI评估外貌引发关注。失明记者Milagros Costabel撰文探讨用视觉语言模型作“虚拟镜子”的挑战与隐患,如AI会给出评判性反馈,心理学家担心这加剧抑郁焦虑。产品应提供客观解读。

DeeplearningAI
算法论文8

AdaGen: 让图像生成模型学会自适应策略

当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。

机器之心
产品应用7

基于 Gemini 模型做 SEO Agent 简单实战

作者参加 Google I/O 大会后,受 James 用 AI 做 SEO 启发,尝试基于 Google 的 Gemini 2.5 Pro 模型制作 SEO 智能体。介绍数据获取方法,构建 3 个 Agent 进行分析、提建议和输出报告,Gemini 负责理解决策,适合出海企业。

特工宇宙
算法论文8

MoCa:首个大规模双向多模态表征模型

为解决VLM用于嵌入的痛点,中国人民大学等机构研究者提出MoCa框架,可将单向注意力VLM训练成双向多模态编码器。它分两阶段,实验效果好,未来可拓展模态、提升多语言适应等。

PaperAgent
算法论文8

耶鲁大学研究揭示 AGI 时代的残酷现实

耶鲁大学论文揭示AGI时代残酷现实,人类将失去经济价值。AGI会自动化“瓶颈”工作,人类从事“辅助性”工作,工资取决于计算成本,劳动收入占比趋近零,应思考财富重分配。

宝玉AI
推荐文章7

2026 初的大模型,离电影 Her 还有多远?

作者重看电影《Her》后,对比 2026 年初现实 AI 与电影中萨曼莎的能力,从七个维度分析差距。指出功能性上已接近,但存在性层面差距大,还探讨了 AI 发展趋势与存在意义。

特工宇宙
开源动态8

刚刚,Kimi开源架构,开始押注线性注意力

智能体时代推理计算需求成瓶颈,线性注意力可降复杂度但表达有限。月之暗面开源 Kimi Linear 架构,结合线性与全注意力,性能和硬件效率出色,引发对线性与全注意力发展方向的思考。

机器之心
新闻资讯8

从高考到实战,豆包大模型交卷了

火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。

机器之心
开源动态8

SGLang 优化Triton FusedMoE 的一个技巧​

蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。

GiantPandaLLM
推荐文章7

虚拟智库:运用大语言模型获取多元视角

本文探讨如何用大语言模型(LLM)构建虚拟智库。以电商系统架构决策为例,通过让 LLM 扮演不同角色,如 Martin Fowler、David Heinemeier Hansson 等,从多元视角讨论微服务架构利弊,为架构决策提供参考。

InfoQ