性能评测」共找到 2489 篇相关文章

产品应用8

万卡竞赛背后:容器正在成为AI时代的调度大脑

今年 Agent 与 AIGC 应用大爆发,Gartner 预计 2027 年超 75%的 AI/ML 工作负载将用容器技术部署。但现有容器技术栈不能直接用于 AI 业务,需解决两大技术挑战。阿里云 ACK 和 ACS 协同演进,应对挑战并不断突破,还积极投入开源。

InfoQ
算法论文8

教AI「择偶生娃」,复刻自然演化!上交校友提名最佳论文

Sakana AI受自然演化启发提出全新模型融合进化方法M2N2,引入‘择偶机制’让AI‘竞争、择偶、繁衍’。此研究获GECCO 2025最佳论文提名,M2N2表现优于其他算法,还避免‘灾难性遗忘’。

新智元
算法论文8

智能体新范式Chain-of-Agents,多项任务新SOTA

论文提出Chain-of-Agents (CoA) 范式,结合多智能体系统与工具集成推理优势。通过多智能体蒸馏和智能体强化学习训练智能体基础模型(AFM),实验显示其在Web和Code任务上达新SOTA,效率、泛化性佳。

深度学习自然语言处理
算法论文8

Sora没做到的,LongVie框架给解决了,超长视频生成SOTA

视频生成近年进步大,但生成超1分钟高质量长视频仍难。上海人工智能实验室等机构提出LongVie框架,解决时序不一致和视觉退化问题,还推出评测基准LongVGenBench,该框架在多项指标达SOTA。

机器之心
算法论文7

从BERT到T5再到Qwen3:关于Embedding的八点总结

哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。

PaperAgent
算法论文8

华人团队终结Token危机:扩散模型数据潜力超自回归三倍

最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。

量子位
新闻资讯7

因为GPT-5,这群人决定在Reddit上起义。

OpenAI上线GPT - 5时下架旧模型,引发用户不满。在Reddit等社区,用户掀起“还我GPT - 4o”运动,大媒体跟进。奥特曼改口,GPT - 4o回归部分付费用户,免费用户需充值。开发者与用户存在认知鸿沟。

数字生命卡兹克
产品应用8

单机狂飙4万亿参数,国产AI「四大天王」首次合体!这台超节点鲨疯了

国产「四大开源天王」可在单机运行,背后是「元脑SD200」超节点。它有超大显存、高速互联域和超强算力,支持64路本土GPU且可商用。浪潮信息以开源为战略加速大模型商业化落地。

新智元
开源动态8

欢迎 GPT OSS —— 来自 OpenAI 的全新开放模型家族!

OpenAI推出GPT OSS开放模型家族,含117B参数的gpt‑oss‑120b和21B参数的gpt‑oss‑20b。采用Apache 2.0许可证,资源占用低、推理快,适多场景,已接入Hugging Face服务,还介绍了推理、部署等内容。

Hugging Face
新闻资讯7

The Information:揭秘 OpenAI GPT-5 崎岖的研发之路

The Information揭秘OpenAI GPT - 5研发困境,今年OpenAI遇技术难题,o3等模型研发受阻,内部有分歧。不过GPT - 5在编程等方面有提升,虽难与早期飞跃相比,但改进仍有价值,公司还在开发‘通用验证器’。

宝玉AI