「长文理解」共找到 805 篇相关文章
n8n、扣子太难用了,Vibe Workflow 才是更大众的解
本文介绍 Refly.AI 推出的 Vibe Workflow,该产品获朱啸虎、高瓴投资且开源。它让普通人搭 Workflow,用 Agent 节点替代传统节点,降低门槛,还能迁移其他平台数据,核心是借模型提升发展。
攻克长文档与多模态挑战,Paper2Video实现学术视频的自动化生产
新加坡国立大学 Show Lab 团队主导研究,提出 Paper2Video 基准及评价指标,还推出 PaperTalker 多智体框架实现学术视频自动化生产,实验显示其在多方面表现佳,效果接近人工水平。
百度搜索 10 年来最大改版,支持超千字长文本输入和 MCP 调用
7月2日,百度搜索宣布十年来最大改版,搜索框变“智能框”,支持超千字输入,集成AI写作等功能。“百看”功能、AI助手升级,接入视频生成模型MuseSteamer,还接入1.8万+MCP,提升搜索体验。
谷歌让机器人「长脑子」了!首发离线具身VLA模型,断网精准操控
谷歌首发具身智离线模型Gemini Robotics On-Device,实现VLA多模态大模型在具身机器人本地离线运行,无网络也能稳定运行。谷歌还开源了SDK,具身智能迈向实用化新阶段。
RSI离我们有多远?这家中国团队给出了第一梯队的工程解
目前行业探讨大模型的RSI时,常陷入思维定势。EvoMap团队没有盲目跟风,而是提出极具现实意义的工程新路径,构建自进化智能体,让经验在网络流转,还以硬核数据证明其体系有效性。
金融AI武道大会开赛!四道业务真题,出题人:猜不到最优解
AFAC2026金融智能创新大赛开赛,赛题源于真实金融场景,如识别交易行为、还原金融文档等。它强调回归基础研究,探索模型产业价值,是今年金融AI领域值得关注的比赛。
能查信息≠循证AI:OpenEvidence爆火在前,中国医生的「信任死结」谁来解?
AI医疗市场增长快,但国内落地面临医生信任难题。医渡科技发布的医渡智循,通过全流程技术体系、多专科智能体协作等,解决AI信任问题,实现全场景布局,让AI回归循证。
腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!
腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。
不跟英伟达走老路,这家GPU公司的技术架构藏着哪些关键解?
在国产GPU上市黄金窗口期,天数智芯上市后首场发布会引发广泛讨论。其公布架构路线图,2027年前追赶英伟达,之后转向创新架构设计。还提出回归计算本质、提供高质量算力两条架构判断,并展示边端算力产品及应用。
【梁文锋署名】DeepSeek再发新论文:75%思考+25%记忆,这是他们算出来的最优解
DeepSeek新论文《Conditional Memory via Scalable Lookup》提出Engram模块,指出大模型用计算模拟查字典是浪费算力,Engram能给模型装“记忆”,还发现参数分配呈U型缩放定律,推理和长上下文能力提升显著。