「虚拟开发团队」共找到 4826 篇相关文章
紫东太初开源视觉神经增强方法,即插即用终结多模态幻觉 | ACL 2025
中科院自动化所等团队提出VHR方案,通过“视觉神经增强”机制放大模型视觉关键注意力头输出,降低幻觉现象。此前主流方法多作用于最终输出阶段,VHR深入干预内部机制,还介绍了SSL语义引导方法。
如何重现 DeepSeek 推理性能突破
DeepSeek-V3 是热门开源大模型,采用大规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。
OpenAI推出云端编程智能体Codex,进一步推动软件工程领域变革
OpenAI昨夜发布研究预览版Codex,一款集成在ChatGPT中的高级编码智能助理。它基于codex - 1模型,支持多种编程语言,有深度代码分析等核心功能,还有codex - mini - latest API版本,或重构软件开发行业。
狗子被人类驯化后,脑子萎缩了一半
法国团队研究发现,狗被驯化后大脑容量缩减。35000 - 15000 年前犬类脑容量未缩减,5000 - 4500 年前脑容量比同期狼小 46%,现代家犬比狼小 32%。这或与农业革命人类需求有关,且不意味狗变笨。
仅需一个混频器的无线射频机器学习推理,登上Science Advances!
杜克大学和MIT教授团队提出广播模型并在射频上完成计算的分离式计算方案,在边缘端混频器模拟计算中完成推理,解决传统方案问题,还在测试平台验证,能耗低且能完成多项机器学习任务。
硅谷大佬带头弃用 OpenAI、“倒戈”Kimi K2!直呼“太便宜了”,白宫首位 AI 主管也劝不住
硅谷正从昂贵闭源模型转向便宜开源替代方案。“SPAC 之王”Chamath Palihapitiya 团队将大量工作负载迁移至 Groq 平台的中国模型 Kimi K2,因其性能优且成本低。节目中还探讨中美开源模型现状等。
LSTM之父向何恺明开炮:我学生才是残差学习奠基人
LSTM之父Jürgen Schmidhuber替学生Sepp Hochreiter发声,称残差学习30年前已诞生,1991年Sepp就用循环残差连接解决梯度消失问题,为残差思想奠基。他觉得将成果全归何恺明团队有失偏颇。
从技术狂欢到企业落地,智能编程的全球破局战
智能编程是AI应用增长快的赛道,正从代码补全迈向AI自主开发。国内模型能力提升,阿里Qwen3 - Coder超越部分闭源模型。阿里云通过多策略破局,其产品助力企业落地,但仍面临适配、安全等挑战。
设计师大解放!清华发布「建筑平面图」自动生成模型 | ACL'25
清华大学吕帅团队提出FloorPlan-LLaMa模型,采用自回归生成架构与RLHF机制,解决传统平面图自动生成模型‘指标优秀但实际不可用’痛点,提升生成式平面图设计质量与实用价值。该论文被ACL录用获领域主席奖。
不愧是中国机器人,乒乓打得太6了
清华姚班本科生苏智团队在论文中提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验中击球和回球率高,还能连打106拍。