「零和游戏」共找到 7301 篇相关文章
NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下多模态冠军!
英伟达推出全模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,多测试中大幅超 Qwen2.5 - Omni,且训练量仅为其六分之一。其架构经多阶段流程实现全模态理解,还支持多种功能。
微软机房大量英伟达GPU开始吃灰……
微软CEO纳德拉承认,因缺电、缺机房空间,大量英伟达AI芯片闲置。这不仅是微软烦恼,也是大模型巨头共同问题。奥特曼称行业挑战在能源与基础设施匹配,算力企业也在调整策略。
评论送书 | 一文读懂多Agent系统演进趋势
文章指出多Agent系统成大模型应用重要方向。分析大模型交互的上下文瓶颈,如语义膨胀、信息密度不均等;阐述Agent间协同结构演化,包括松耦合编排、语义协同等;还说明传统Prompt工程局限及通信与上下文协议的作用。
Coatue 最新报告:复盘 400 年、 30+ 次泡沫,我们离 AI 泡沫还很远
Coatue 最新报告否定‘AI 泡沫论’,结合市场与消费数据,表明 AI 拉动经济。复盘历史,推出‘泡沫评分标准’。反驳市场对 AI 的 8 大质疑,还指出谷歌转型成功,预计未来 AI 利润可观,给出投资原则与指标。
可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25
研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。
Yoshua Bengio,刚刚成为全球首个百万引用学者!
计算机科学家Yoshua Bengio成Google Scholar上首个引用超百万的人。他是深度学习“三巨头”之一,在“AI寒冬”坚守研究,成果显著。如今他担忧AI风险,积极推动伦理准则和监管。
AI是否足够的中立?宾夕法尼亚大学发现AI训练数据中的隐形偏见
宾夕法尼亚州立大学和俄勒冈州立大学研究发现,普通用户难察觉AI训练数据中种族与情绪绑定的偏见,直到AI性能表现出明显偏见才会警觉。不同族裔对偏见感知有差异,黑人更易识别。
不改模型也能提升推理性能?ICLR投稿提出测试时扩展新范式OTV
ICLR 2026投稿论文提出单token验证(OTV),是测试时扩展新机制,让模型能边推理边判断正误。它基于并行思考思路,借助轻量内部验证器分析推理过程,实验显示其性能优于主流方法。
HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴
蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。
Codeforces难题不够刷?谢赛宁等造了个AI出题机,能生成原创编程题
LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,在测试用例生成上可靠性佳,还能生成新问题,同时揭示了LLM在创作上的优劣势。