结构化文档识别」共找到 997 篇相关文章

产品应用8

音乐新王震撼降临,Al音乐进入格莱美时刻

2026开年,MiniMax Music 2.5发布,凭「格莱美级」音质、极致拟真人声开创AI音乐新高度。它消除中文演唱「洋味儿」,支持14种结构标签精准控制,让音乐制作门槛降低,从C端娱乐迈向B端生产力。

新智元
新闻资讯8

多模态文本智能白皮书发布!5大能力标准、11个行业案例全解析(附下载)

合合信息发布《文本价值觉醒,赋能智能决策——多模态大模型文本智能白皮书(2026)》,提出复杂文本智能五大核心能力标准,还通过11个真实行业标杆案例展示技术如何转化文档为决策力。

PaperAgent
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心多个角色吵翻了

谷歌等机构研究指出,推理模型能力提升源于‘思维社会’,即模拟类多智能体交互结构。如 DeepSeek - R1 等在推理中展现高视角多样性,对话特征能提升推理准确率,还提出利用‘群体智慧’新方向。

机器之心
算法论文8

不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化

随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。

机器之心
产品应用8

滴滴给我发了个赛博助理,专管出行的那种

滴滴上线的Agent小滴,让打车更智能个性。用户只需一句话,就能提出多样需求,小滴还能识别模糊需求。它激活了滴滴运营积累,体现行业新趋势,成了用户的赛博出行助理。

量子位
推荐文章7

看完 Manus、Cursor 分享后的最大收获:避免 Context 的过度工程化才是关键

上下文工程优化是Agent创业公司新一年竞争重点,其信息质量很大程度决定Agent表现。文章结合Manus、Cursor团队思路,给出做好上下文工程要点,如缩减上下文、搭建工具行动空间、多Agent协作等。

Founder Park
算法论文8

智能体如何学会「想象」?深度解析世界模型嵌入具身系统的三大技术范式

长期以来具身智能系统缺预测力,世界模型让智能体有了‘想象’未来的能力。中科大等机构团队综述将现有研究划分为模块化、顺序、统一三大架构集成范式,并指出未来研究方向。

机器之心
算法论文8

医疗AI迎来大考!南洋理工发布首个LLM电子病历处理评测 | AAAI'26

南洋理工大学研究人员构建EHRStruct基准,涵盖11项核心任务、2200个样本,用于评测LLM处理结构化电子病历的能力。研究发现通用大模型优于医学专用模型,提出的EHRMaster框架与Gemini联合后性能超现有模型。

新智元
新闻资讯7

ICLR 2026还会好吗?300篇投稿50篇含幻觉,引用example.com竟也能过审

GPTZero扫描300篇ICLR 2026投稿论文,发现50篇含引用幻觉,如用example.com作引用,且经同行评审也未识别。学术会议和期刊在AI重压下不堪重负,GPTZero幻觉检测工具或助同行评审。

机器之心
算法论文8

让大模型学会「心灵感应」:基于思维沟通的多智能体合作范式来了

NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。

机器之心