「社区联合型会议」共找到 1557 篇相关文章
给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理
如今大模型长上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。
信通院&清华提出FedRE:用「纠缠」搞定联邦学习三难困境 | CVPR 26
联邦学习中兼顾模型性能、数据隐私和通信开销是挑战,尤其在模型异构场景。信通院和清华联合团队提出FedRE框架,能适配异构与同构场景,保证性能同时保护隐私、降低开销。
龙虾也能当导演了!LibTV解锁全自动拍片,一句话从剧本干到成片
LiblibAI推出AI视频产品LibTV,是一站式AI内容创作社区。它把人和Agent当平等用户设计,人类可自由操控画布创作,也能让Agent一句话全自动出片,还集成多种模型,定价有竞争力。
国产算力解决方案,如何赋能“AI for Science”?
AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。
让AI读懂「言外之意」:AI4SG团队发布首个心理健康污名语料库,破解隐性偏见识别难题
心理健康患者常面临社会偏见,且这种污名化隐蔽难识别。新加坡国立大学AI4SG团队联合多学科专家,构建首个心理健康污名访谈语料库MHStigmaInterview,获ACL 2025认可,为解决该社会问题提供技术支持。
LTX-2开源:首个能同时生成视频和音频的模型
LTX-2开源,它是Lightricks团队开发的首个开源多模态基础模型,能联合生成音频和视频。采用非对称双流扩散变换器架构,用深度多语言文本编码器,速度比许多纯视频开源模型快,让模型理解声画关联。
Being-VL的视觉BPE路线:把「看」和「说」真正统一起来
北大、UC San Diego 和 BeingBeyond 联合提出 Being-VL 的视觉 BPE 路线,先将图像离散化并「分词」,再与文本统一建模,能缩短跨模态链路、保留视觉结构先验,还介绍了实现步骤、训练方式等。
OpenAI携手五巨头开源革命性超算协议:一举解决超大集群LLM训练不稳定和网络性能难题
OpenAI联合英伟达等五巨头推出超算开放网络协议MRC并正式向行业开放。MRC目标是性能可预期,有多平面网络、自适应包喷射、SRv6源路由三大核心机制,已在OpenAI多台超级计算机上部署。
空间智能新作,影石开源户外全景重建算法
近日,Insta360 研究院联合高校提出 PanoLOG,首个面向全景输入的大规模户外三维重建工作。它解决全景分区难题,在多基准上取得领先渲染质量与小模型体积,还为户外具身智能等提供新思路。
Claude Mythos官宣!性能碾压Opus 4.6,因太危险遭「囚禁」
Anthropic官宣最强模型Claude Mythos预览版,性能全方位碾压Opus 4.6。但它存在致命缺陷,攻击安全漏洞能力超多数黑客。Anthropic暂不向公众开放,联合巨头开展安全计划,称需各方共筑网络安全。