「文本生成视频」共找到 2970 篇相关文章
上交大智能计算研究院论文:不只算对答案,大模型如何真正学会运筹建模丨ICLR 2026
上海交大智能计算研究院提出 StepORLM,通过生成式过程监督提升运筹建模可靠性。研究反思传统训练范式局限,在多数据集测试中,小参数的 StepORLM 表现超大型模型,还分析现有方法缺陷并提出解决框架,有重要方法论和应用意义。
被员工怒怼“磕了”,追觅CEO:我有肚量;AI恋人陪聊涉黄被判刑,2.4万人付费;马斯克、奥特曼又开撕|AI周报
本周AI热点众多,有AI恋人陪聊涉黄案二审,追觅CEO回应员工怒怼,携程涉垄断被查等行业事件;还有文心大模型5.0登顶国内文本榜、字节跳动发布SeedFold等大模型进展;以及苹果、谷歌等企业的应用合作动态。
天玑9500s正式登场!扩图消除本地跑,《原神》极高画质满帧运行
联发科技发布次旗舰新品天玑9500s,搭载旗舰机NPU,可流畅运行复杂端侧生成式AI模型,还采用3nm制程等,让《原神》极高画质满帧。此外,还推出天玑8500,Redmi Turbo 5 Max将首发天玑9500s。
告别碎片化日志:一套方案采集所有主流 AI 编程工具
在AI编程工具普及的当下,有效采集和分析AI代码生成数据成重要课题。该文介绍一套基于MCP架构的多AI工具代码采集方案,支持多种工具和操作系统,有轻量化、用户无感等特点,已和Aone合作。
SIGGRAPH Asia 2025最佳论文 | 港中大、曼彻斯特大学获奖
SIGGRAPH Asia 2025将“最佳论文奖”颁给港中大与曼彻斯特大学团队研究。该研究提出全新切片计算框架,把切片生成与路径规划转化为数学优化问题,解决传统DLP 3D打印难题,还介绍了进阶策略和实验结果。
当LeCun还在「画饼」,中国AI大牛领先李飞飞一步把世界模型开源了
具身智能突破「遥操作」数据桎梏,商汤联合创始人王晓刚领衔的大晓机器人发布全球首个开源商业落地世界模型「开悟3.0」。它是多模态理解 - 生成 - 预测一体化,有强物理感知力,还解决了空间感和时间记忆问题。
2.4万亿参数原生全模态,文心5.0一手实测来了
文心5.0正式发布,主打原生全模态,支持全模态输入和输出。官方测试显示其多维度表现突出,在LMArena文本排行榜并列全球第二。实测其理解精细、能捕捉细节,技术上采用自回归统一结构和超大规模混合专家架构。
跟不上、读不完?上万篇顶会论文,这个工具一键分析
加州大学圣迭戈分校等机构开发 Real Deep Research(RDR)系统,可自动完成领域综述与趋势追踪。它从顶会收集论文,压缩成摘要并聚类,还能生成综述、绘制趋势图谱。与已有方法不同,它结合自动化与专家知识。
腾讯混元图像3.0开源榜一,工业级800亿参数可商用,附提示技巧
28日,腾讯开源800亿参数的工业级原生多模态生图模型HunyuanImage 3.0,个人和月活≤1亿公司可免费用。它是全球参数量最大、性能最好的开源图像生成模型,技术强、评估表现优,官方还整理了提示词手册。
DeepDiver-V2来了,华为最新开源原生多智能体系统,“团战”深度研究效果惊人
华为发布DeepDiver-V2原生多智能体系统,采用“团队作战”模式,在复杂知识问答和长文报告生成上表现出色。它以Planner为中心协调多个Executor,有智能任务分解等优势,训练也有新机制,昇腾NPU集群加速。