「非凸优化」共找到 1820 篇相关文章
Mamba核心作者新作:取代DeepSeek在用的注意力机制,专为推理打造
Mamba核心作者Tri Dao团队提出GTA和GLA两种专为推理定制的注意力机制,在减少KV缓存用量、保持模型质量的同时,显著提升解码速度,优化长上下文推理能力。
不懂建模也能做角色!VAST升级AI神器,一手实测来了:一键拆建/魔法笔刷/万物绑骨
3D大模型明星初创公司VAST推出的Tripo Studio大升级,有智能部件分割、贴图魔法笔刷等四大核心功能,直击过去建模流程痛点,实现从“给模型”到“交成果”的质变,提升全链路效率。
Google搜索转型,Perplexity入不敷出,AI搜索还是个好赛道吗?
Google在I/O开发者大会宣布上线由Gemini驱动的高级AI搜索模式AI Mode,此前其因转型冲击收入而犹豫。Perplexity访问量增但亏损,AI搜索赛道融资减少,大厂抢占空间,产品转垂类,商业化待探索。
DeepSeek发布最新论文,5大杀手锏让大模型训练、推理暴涨
全球著名开源大模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。
AI辅助编码将如何改变软件工程:更需要经验丰富的工程师
文章指出生成式AI改变软件开发方式,LLM在编码领域成果显著。但AI辅助编码有局限,如‘70%问题’。还介绍有效模式,提及软件工程智能体兴起,最后认为未来对经验丰富工程师需求或增加。
长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文
长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。
智能体时代EDA工具革新,比昂芯科技专注AI驱动电路仿真及Chiplets设计
近期,AI+芯片设计生成成全球资本热门赛道。比昂芯科技早在2024年就启动AI在EDA领域的底层技术探索,形成AI原生EDA完整技术闭环。其研发总监吴晨博士在IDAS 2026分享实践,公司还有四大核心产品及服务。
Agentic AI的第三种范式来了,16家机构提出「伴身智能体」
16家海内外高校与科研机构的22位研究者提出ComBodied Agents新范式,它围绕人的长期状态与主体性构建。论文给出闭环技术框架与评测标准,还提到研究难点与风险,也为产品实践提供指导。
夜光影像里的"暗船":双分支 YOLO11 如何用抓非法捕捞
非法捕捞的暗船常关掉 AIS 隐身,难被传统手段监控。论文提出双分支 YOLO11,通过夜光遥感数据精准检测,还设计预处理流程,在测试集表现优,规模化应用也得到暗船率等成果。
南科大教授余沛源创业做AI+材料:真正难的不是生成,而是验证
南科大教授余沛源创业成立三向纪元,构建可验证材料模型。他认为AI+材料研发难在验证,当下是产业化窗口期,中国有优势,初创企业与大厂各有优劣,公司有独特技术与商业模式。