「高性能渲染」共找到 3513 篇相关文章
VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案
常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。
刚刚,谷歌DeepMind登Nature封面!人类40亿年生命代码「开源」了
谷歌AlphaGenome登上Nature封面,可一次性「读入」100万个DNA碱基对,对数千种分子特性高度预测。它已在GitHub开源,诺奖得主称未来十年AI将治愈所有疾病,其重构了生命科学底层逻辑。
硅谷真实「无间道」!OpenAI前CTO怒斩泄密联创,奥特曼打包收了
硅谷AI圈上演“无间道”,Thinking Machines Lab掌门人Mira Murati开除被指泄密的CTO Barret Zoph,OpenAI迅速接人。这重创了TML,Mira宣布“PyTorch之父”Soumith Chintala出任新CTO。
GEO破圈,豆包爆火,为什么我劝你别轻易丢掉SEO?
A股GEO概念股大涨、罗永浩与豆包对话爆火,让老板和SEO朋友焦虑是否转型GEO、SEO是否凉了。作者认为GEO是未来要重视,但不能丢SEO基本功,还给出构建“SEO+GEO”双引擎的建议。
谷歌云重磅报告:AI智能体接管2026年企业核心工作流
谷歌云基于调研发布报告,揭示2026年重新定义角色、工作流和商业价值的五大关键趋势,如智能体重塑员工、数字化流水线打通企业、全时在线重塑客户体验等,还强调人才技能重塑的重要性。
字节手里的牌,比收购 Manus 更狠 - AnyGen 体验一周有感
本文作者分享使用字节海外推出的通用AI Agent产品AnyGen的体验,介绍其功能亮点、多场景测试效果,对比竞品,认为它定位职场场景,性价比高,或引领通用Agent竞争转向用户体验。
英伟达开源上瘾了!推出了一款实时语音智能体的终极 ASR:24ms 极速锁定。
英伟达开源了Nemotron Speech ASR模型,它是低延迟、实时流式语音识别模型,单句转录锁定仅需24毫秒。其核心能力包括缓存感知、运行效率高、动态运行灵活,还被放进完整语音智能体方案。
Qwen3-VL-Embedding系列上新:探索统一多模态表征与排序
2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理多模态输入,在多任务达业界领先,还介绍了特性、评测及使用方法。
「全球大模型第一股」来了!智谱港交所敲钟,市值达528亿港元
2026年1月8日,智谱登陆港交所,成全球首家以AGI基座模型为核心业务的上市公司,市值528.28亿港元。它以‘全球大模型第一股’吸引资本,研发强、MaaS模式优,标志中国AGI企业走向资本市场。
别被室内基准高分骗了:大模型是在推理空间,还是在「背答案」?
2025年,空间智能成大模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院大学等机构发布OSI - Bench重新审视大模型空间能力,评测显示当前提升可能是虚假繁荣。