「中国中文信息学会」共找到 1651 篇相关文章
Sora 2干翻Veo 3?超全对比实测:会中文脱口秀,但体操翻车,附有效邀请码
OpenAI推出Sora2,可生成20秒1080p视频,在物理准确性等方面更优,还具备音画同步能力。文章对Sora2和谷歌Veo3进行多轮对比实测,涉及不同场景,也提及Sora2版权保护及App相关情况。
32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1
2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。
“机器人一次性卖完太亏!”真机智能刘智勇:今年中国本体厂商将大淘汰,拼的是世界模型?
InfoQ采访真机智能刘智勇,探讨具身智能领域进展、技术瓶颈及商业方向。刘智勇指出,VLN技术有进展但导航成功率待提升,世界模型可提升机器人能力,2026年本体厂商将收缩,盈利是核心。
攻克大模型「表格盲区」!ST-Raptor框架发布,实现复杂半结构化表格的精准理解与信息抽取
半结构化表格布局多样、结构复杂,让自动化数据处理困难。上海交大等团队发布 ST - Raptor 框架,提出 HO - Tree 数据结构及树上操作,构建 SSTQA 数据集,提升表格问答准确率,弥补大模型处理短板。
2个月,20亿美元估值、硅谷7500万美元投资,Manus给中国AI创业者指了条什么路?
文章以Manus为例,分析其国内被质疑、海外却受青睐的原因。指出它虽无自有模型,但为巨头带来增量价值。还借量子隧穿效应说明其先发红利,最后探讨其挑战、目标及对“套壳”看法。
一个能思考、会记忆的AI导演诞生了!新加坡管理大学,香港中文大学等实现故事化视频生成
新加坡管理大学等提出开源全能多智能体框架UniVA,可统一视频理解、分割等能力,按指令生成完整故事视频。还引入UniVA - Bench基准测试套件,实验显示其在多任务中表现出色,代表视频智能生成重要进步。
宇宙尺度压缩:Scaling Law的边界,柏拉图表征收敛于物质和信息交汇,解决P与NP问题,Simulation假说……
超对称公司在BigBang - Proton实现跨尺度跨结构科学多任务学习,提出宇宙尺度压缩构想。文章论证其科学基础、工程可行性与意义,探讨Scaling Law边界,还给出宇宙尺度压缩计划和相关假设。
AI时代的传统车企转型:广汽的“双核”战略、组织裂变与自研之路|行知数字中国
本文讲述广汽集团数字化转型历程与规划。在新兴车企冲击下,广汽开启转型,从组织架构破冰到技术突破。转型中业务、组织、文化三重裂变,现进入 GDA 3.0 提出双核战略,还分享国企转型方法论及自研重要性。
看到这个小红书卖虚拟产品获利百万的案例,我才发现AI翻译的信息差真大
作者建议AI开发者先了解大众需求再做产品。分享小红书上AI翻译变现案例,还展示智谱BigModel开放平台翻译智能体的多模态翻译案例,介绍其解决AI翻译问题的亮点及适用场景。
仅保留35% Token,性能反超原模型!快手可灵等用视觉信息引导音频压缩,推理时间直降42%
Omni - LLM计算浪费严重,快手可灵等团队提出OmniSIFT框架。它利用音视频非对称依赖关系,通过时空联合剪枝压缩视频、视觉引导筛选音频Token,大幅减少Token数量,提升性能和推理效率。