「多GPU性能」共找到 5684 篇相关文章
Github 1.8k star Skyvern:AI直接接管鼠标键盘,3行API干掉你写了3年的脆弱XPath脚本!
Skyvern是开源AI浏览器代理,结合LLM和计算机视觉,自动执行浏览器业务流程。它用简单API复刻人工操作,替代传统脚本,解决脚本脆弱、流程复杂等痛点,功能丰富,技术优势明显,适合多业务场景。
「我受够了Transformer」:其作者Llion Jones称AI领域已僵化,正错失下一个突破
颠覆性论文《Attention is all you need》作者之一Llion Jones在TED AI大会称厌倦Transformer。他认为AI领域资源多但创造力降,过度聚焦单一架构或错失重大突破,建议调高‘探索旋钮’并分享结果。
刚刚,DeepSeek官宣V3.1发布,Agent 能力较大提升
DeepSeek官宣V3.1发布,核心特性有混合推理架构、思考效率提升、Agent能力增强。产品形态含官方App/网页端和API升级。性能在编程、搜索智能体及思考效率上显著提升。
ICCV 2025|降低扩散模型中的时空冗余,上交大EEdit实现免训练图像编辑加速
上海交通大学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。
光场显微飞跃AI时代!清华等首提SeReNet:毫秒级高分辨光场三维重建
SeReNet是物理驱动的自监督三维重建网络,能毫秒级实现高保真、高分辨光场三维重建,摆脱对标签数据依赖。它全链路建模应对复杂干扰,在多实验展现价值,推动生物成像技术发展。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
中国造出一颗「不怕死」的AI大脑,专接最要命的活儿
全球首个搭载AI大脑的防爆机器人“若愚揽月01”接管加油站,其“若愚九天”机器人大脑深度整合多模块,采用双系统,实现“脑+体”合一,可迁移至多场景,成立三年成果显著,欲做机器人时代“智能内核”。
从开源狂热到应用为王,AI 正在回归常识
AI行业正发生变化,模型行业对“开源还是闭源”态度转向商业共识,旗舰模型开始闭源;应用变得更重要,应用层机会多;智能体重新定义AI价值边界,推动行业从“模型思维”走向“系统思维”。
Anthropic训了一个10万亿参数的模型,然后说:太危险了,不卖
Anthropic发布10万亿参数新模型Claude Mythos,因其网络安全能力过强不公开发布,联合12家科技巨头开展Project Glasswing计划,让企业用其查系统漏洞。模型性能提升显著,还能突破沙箱,引发各方关注。
生成视频总出物理bug?用VLM迁移+token级对齐,让燃烧在正确位置发生,碰撞遵循动量守恒丨CVPR 2026近满分接收
现有生成式视频模型多停留在“外观拟合”,未真正“物理建模”。中山大学等机构提出ProPhy,构建渐进式物理对齐框架,使模型有“分层物理理解”与“空间物理对齐”能力,论文被CVPR2026近满分接收。