「4D视频生成框架」共找到 3887 篇相关文章
AI驱动的研究报告生成器Open Deep Research
Open Deep Research是AI驱动的研究报告生成器,用户提问题可获全面且有来源的答案。它采用Next.js 15等技术栈,经多步骤生成综合报告,还介绍了克隆与运行方法及项目地址。
Relink:为GraphRAG动态构建证据图
大语言模型在开放域问答中有‘幻觉’问题,GraphRAG结合LLM与知识图谱缓解此问题,但现有方法有缺陷。作者提出‘推理并构建’新范式和Relink框架,实验显示其性能领先,对RAG系统设计有启示。
7B打败o3、GPT-5!医学AI智能体让模型学会“看哪里、怎么看”
上海创智学院LeapQuest团队联合多校,在ICML 2026接收两篇论文,提出“Think with Images/Think with Videos”范式,让视觉证据参与模型推理,Ophiuchus和MedScope分别用于图像和视频诊断,表现出色。
一天斩获2.5k星星!首个可以「让AI直接画CAD」的开源项目来了
新开源项目text - to - cad很猛,只需把需求告诉AI,它就能生成可编辑3D模型、导出文件,还能预检。支持多格式,有几何引用等特点,一天获2.5k星。
OpenClaw安全有救了!不改内核、无视AI内部逻辑,数学级枷锁驯服暴走智能体
OpenClaw等智能体能力强大但有安全黑洞,南方科技大学和香港科技大学团队推出ClawLess框架,从底层系统调用源头扼杀智能体出格行为,通过形式化验证、物理隔离、动态验证等手段保障安全。
从实践到原则:为 AI Agent 构建的 Harness Engineering 落地与探索
生成式 AI 进入软件开发核心流程,但 AI 写代码速度超团队控复杂度能力。问题不在模型,而在软件工程系统。Harness Engineering 试图解决此问题,从三层面重新设计工程系统,已有公司实践。
JustGRPO:扩散语言模型的极简主义回归
本文提出回归极简的方法 JustGRPO,在 RL 阶段让模型自回归生成,用标准 GRPO 训练,能超越各类针对 dLLM 设计的 RL 算法表现,提升推理表现同时保留并行解码能力。
11K+ Star!NotebookLM 最强开源平替来了,支持私有化部署!
NotebookLM好用但有数据隐私问题,GitHub上的SurfSense是其开源平替,支持私有化部署。它功能成熟,支持多种文件格式等,提供三种入门方式,虽缺PPT生成能力,但知识管理和问答功能够用。
大型语言模型正在掏空和填满你的钱包
人工智能改变赚钱和花钱方式,生成式AI每年或为全球经济增2.6 - 4.4万亿美元。文章介绍LLM在多领域应用,如客服降成本、内容创作提效率等,企业应积极拥抱技术革命。
R1时代,RAG-Retrieval技术总结与展望~
RAG - Retrieval提供全链路RAG检索模型微调、推理及蒸馏代码,支持多模型、多loss和训练方式。还发布模型技术报告,设计评估框架,未来探索RL在检索领域应用。