4D视频生成」共找到 4003 篇相关文章

算法论文8

与Gemini Diffusion共振!首个扩散式「发散思维链」来了

西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型。

机器之心
算法论文7

在Think中边搜索边调整的搜索增强Reasoning方法

LLM虽知识丰富,但无法掌握训练数据外的信息,传统检索增强生成方法有缺陷。AutoRefine提出“先筛选,再回答”理念,用强化学习训练,实验显示在多方面碾压传统方法,未来或改变知识密集型任务解决方式。

深度学习自然语言处理
算法论文8

清华&通院推出"绝对零"训练法,零外部数据大模型自我博弈解锁推理能力

清华、北通院和宾州州立大学研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。

量子位
开源动态7

n8n是开源工作流程自动化工具,提供直观界面创建自定义流程,支持超400应用集成。过去一年增长迅速,活跃用户超20万,ARR增长5倍,GitHub获77.5k star。介绍其创立背景、优势特点,用户评价褒贬不一,还提及与其他工具对比及“公平代码”理念。

冬梅
推荐文章9

一万字Jev 工程实践长文:把 Agent 的“判断题”从大模型里拆出来

本文是一万字Jev工程实践长文,作者结合自研落地Demo,拆解Jev核心设计逻辑,讲解如何将Agent中高频封闭的判断任务从大模型生成链路拆分,解决Agent上下文膨胀痛点,分享工程实现与选型思路。

腾讯技术工程
新闻资讯8

陈大年复出,入局大模型

国产大模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈大年押注本地模型,公司专注该领域商业化。

量子位
新闻资讯7

谷歌邪修Gemini 3.8 Flash!险胜DeepSeek,姚顺宇:RSI一大步

谷歌发布Gemini 3.8 Flash,编码能力提升,在LMArena榜单险胜DeepSeek-V4-Pro,定价与3.7 Flash一致。其输出速度快,但有网友质疑是刷分。此外还有3.8 Flash Cyber,网络安全能力强却不公开发布。

量子位
新闻资讯7

DeepSeek涨价,OpenAI降价,Agent改写了大模型价格战

近期,DeepSeek上调API价格,V4 Pro等型号涨幅明显;而OpenAI的GPT - 5.6 Luna API价格降80%,Terra降20%。这背后是大模型价格竞争方向转变,受竞争、广告、效率及Agent使用方式等因素影响。

DeepTech深科技
新闻资讯7

宇树机器人上市前再破纪录

IPO前夕,宇树科技放出新一代人形机器人「超人」预告视频,其打破两项世界纪录:0.85米短腿原地起跳2米高,冲刺跑峰值速度超博尔特。该机器人仅研发三月多,后续提升空间大。8月19日宇树将上市。

量子位
新闻资讯7

斯坦福辍学生奥特曼:AI时代,大学上两年就够了

在面向科技实习生的活动上,有人问AI时代读大学是否必要,奥特曼认为要读,但四年太长,两年刚好,还列举盖茨等辍学生成功案例,强调辍学非成功公式,大学应给学生更多保障。

量子位