「注意力模式」共找到 1111 篇相关文章
98%准确率!这个双分支AI模型,精准识别木薯叶病害(附代码)
2026年3月论文DenseSwinV2提出双分支AI模型,结合CNN与Transformer,加通道注意力模块突出病害特征。该模型分类木薯叶病害准确率达98.02%,还给出简化版代码,有落地价值。
AI看不懂的色盲测试背后,藏着一场像素与诗意的战争。
作者和同事测试AI色盲测试图,多模态模型Gemini 3 Pro、Claude Opus 4.5等纷纷答错,仅GPT 5.2 Thinking答对且靠代码作弊。研究发现,AI看图断章取义,缺乏人类的“格式塔”能力。
告别卡脖子,华为黑科技破局!昇腾推理加速1.6倍打破LLM降智魔咒
大模型参数规模大,推理部署难。华为诺亚提出Pangu Light框架,结合算法创新与国产昇腾平台,通过跨层注意力剪枝等技术,解决剪枝后模型失稳问题,实现高压缩率、推理加速与高精度。
网友晒 21 页 PDF 质疑 Grok 3 套壳 Claude,Grok 3 自己承认了!xAI 工程师被喷无能
网友 GpsTracker 爆料,埃隆·马斯克旗下 xAI 公司的 Grok 3 模型在“思考模式”下自称是竞争对手 Anthropic 公司的 Claude 3.5。网友提供对话记录和 21 页 PDF 佐证,引发社区对模型异常原因的讨论。
吴恩达来信:削减科研经费,削弱国家实力
吴恩达对美国拟削减基础研究经费表示震惊,认为会影响其竞争力。他以自身经历说明资助重要性,指出资助本国研究利好最大,还提及中国科技生态开放实现快速发展,呼吁美国坚守资助科研的模式。
AI精准编辑门槛大降:开源框架提升编辑一致性,即插即用
近日,中山大学、香港中文大学等团队发布研究成果ProEdit。它通过对注意力机制和初始噪声潜在分布处理,实现高精度图像与视频编辑,无需训练、即插即用,解决编辑效果与一致性平衡难题。
中国科学SCPMA | 南科大王建春团队:基于改进隐式轴向分解Transformer的三维槽道湍流快速预测
南科大王建春团队改进IFactFormer模型,采用“并行”轴向分解注意力机制,提升在复杂流动问题中的表征能力和稳定性。实验显示,改进模型拟合与长期预测能力强,多数指标精度优于传统方法。
被低估的ChatGPT新功能,10分钟搞定DeepSeek代码库深度研究
ChatGPT悄悄上线直连Github新功能,能自动读取、解析并总结整个GitHub仓库,可快速输出专业研究报告,应用场景广,还能避免“幻觉”,Plus用户即可用,开启全新研究模式。
小米、OPPO押注!功率半导体“小巨人”二度冲刺IPO
江苏长晶科技股份有限公司于2025年1月15日重启上市计划,这是其第二次冲击资本市场。该公司产业背景深厚,有小米、OPPO等产业资本入股,技术获官方认可,“Fabless+IDM”模式具供应链韧性。
我不认为几亿人会用豆包「办公」,但 Agent 豆包也必须要做
豆包工作任务新增本地电脑和云电脑切换模式,补上AI Agent关键工作条件,产品定位改变。其优势是低门槛且能力提升,虽Agent不够稳定,但有望成全民工具,推动AI进入大众生活。