「视频大模型」共找到 9663 篇相关文章
黄仁勋出手!45倍性能暴涨,英伟达定义物理AI新纪元
在SIGGRAPH 2025上,英伟达发布「物理AI」全家桶。展示完整生态,含新硬件、仿真平台和AI模型。如RTX PRO 6000服务器显卡性能涨45倍,还推多款模型,应用于多领域,推动物理AI落地。
腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合
腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。
刚刚,GPT-6代号再泄露!或将周四见
据传GPT - 6本周将发布,OpenAI「义父」爆料Codex接入最强Astra模型,其内部代号「mewfour」泄露。Astra内部版已解决多个数学难题,成本仅约2000美元,还或达网络安全最高能力阈值,可能开启多智能体原生时代。
DeepSeek V3.2爆火,Agentic性能暴涨40%解密
文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。
给野马套上缰绳:Agent Harness 工程实践 ——从范式理论到钉钉AI招聘的真实落地
本文围绕 Agent Harness 工程实践展开,指出瓶颈在‘装’好模型而非模型本身。介绍 Agent 公式、范式跃迁、四条铁律、工程模式,以悟空 AI 招聘为例说明落地,还分析行业标杆、未来趋势,给出心法。
Claude强到不敢发的Mythos,被质疑用了字节Seed技术
Claude最强“神话”模型Mythos引发猜测,或用了字节Seed技术。社区热议其是否采用循环语言模型架构,关键线索来自Anthropic测试数据,在图搜索测试中Mythos优势明显,还有其他线索指向循环架构。
龙虾连Gemma 4,只需三步,谷歌官方教程出炉,不再花钱买token
谷歌官方发布教程,教大家分三步将 Gemma 4 和龙虾(OpenClaw)连接。有人认为此流程清晰直接,让本地跑 Agent 变得简单。不过 Gemma 4 与顶尖模型有差距,且小模型安全性存疑。
Anthropic最新2026趋势报告:人类最大一次编程革命势不可挡
Anthropic发布《2026年智能体编码趋势报告》,指出编程规则改变,任何人都能成开发者。报告给出8大趋势,如软件开发生命周期剧变、智能体能力提升等,还给出2026年组织需关注的4大领域。
HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴
蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。
锁死一致性!Vidu Q2「参考生」可算来了,新功能强到离谱,APP全面进化
生数科技Vidu Q2「参考生」功能全球正式上线,APP端全面改版。新上线「视频延长」功能,最长扩展5分钟,还在一致性、速度、成本等方面优化,在镜头语言、语义理解等表现出色,APP社交体验好。