「高性能框架」共找到 4581 篇相关文章
VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案
常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。
刚刚,谷歌DeepMind登Nature封面!人类40亿年生命代码「开源」了
谷歌AlphaGenome登上Nature封面,可一次性「读入」100万个DNA碱基对,对数千种分子特性高度预测。它已在GitHub开源,诺奖得主称未来十年AI将治愈所有疾病,其重构了生命科学底层逻辑。
自建一个 Agent 很难吗?一语道破,万语难明
作者分享给传统研发平台接入 Agent 开发能力的经验,介绍技术选型、方案落地、系统提示词优化、知识库建设等内容,还提及工具接入、上下文管理等方面,为想自建 Agent 的人提供启发。
硅谷真实「无间道」!OpenAI前CTO怒斩泄密联创,奥特曼打包收了
硅谷AI圈上演“无间道”,Thinking Machines Lab掌门人Mira Murati开除被指泄密的CTO Barret Zoph,OpenAI迅速接人。这重创了TML,Mira宣布“PyTorch之父”Soumith Chintala出任新CTO。
GEO破圈,豆包爆火,为什么我劝你别轻易丢掉SEO?
A股GEO概念股大涨、罗永浩与豆包对话爆火,让老板和SEO朋友焦虑是否转型GEO、SEO是否凉了。作者认为GEO是未来要重视,但不能丢SEO基本功,还给出构建“SEO+GEO”双引擎的建议。
谷歌云重磅报告:AI智能体接管2026年企业核心工作流
谷歌云基于调研发布报告,揭示2026年重新定义角色、工作流和商业价值的五大关键趋势,如智能体重塑员工、数字化流水线打通企业、全时在线重塑客户体验等,还强调人才技能重塑的重要性。
字节手里的牌,比收购 Manus 更狠 - AnyGen 体验一周有感
本文作者分享使用字节海外推出的通用AI Agent产品AnyGen的体验,介绍其功能亮点、多场景测试效果,对比竞品,认为它定位职场场景,性价比高,或引领通用Agent竞争转向用户体验。
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。
英伟达开源上瘾了!推出了一款实时语音智能体的终极 ASR:24ms 极速锁定。
英伟达开源了Nemotron Speech ASR模型,它是低延迟、实时流式语音识别模型,单句转录锁定仅需24毫秒。其核心能力包括缓存感知、运行效率高、动态运行灵活,还被放进完整语音智能体方案。
Qwen3-VL-Embedding系列上新:探索统一多模态表征与排序
2025年6月曾开源Qwen3-Embedding和Qwen3-ReRanker,现推出Qwen3-VL-Embedding和Qwen3-VL-Reranker。它们基于Qwen3-VL构建,能处理多模态输入,在多任务达业界领先,还介绍了特性、评测及使用方法。