文档图像质量评估」共找到 1317 篇相关文章

新闻资讯8

医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件新玩法:相框

OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。

投资实习所
产品应用8

我们用飞书开了个选题会,一下进入现代化办公,编辑部直呼:真香

2025年飞书未来无限大会上,飞书发布和升级诸多产品。如达M3标准的知识问答,可秒搜文档;达M4标准的飞书会议,支持声纹识别。多维表格性能提升、应用构建升级,还有AI工具全家桶。

机器之心
产品应用8

AnyGen款新AI工具,专门解决打工人最头疼的3件事,Doc,PPT,Excel

字节跳动2025年12月在海外推出一站式AI协作工作台AnyGen,强调人机协作打磨。产品有文档、通用智能体、幻灯片、数据分析四个核心模块,能解决会议纪要整理、PPT制作等痛点,还与主流工具做了横评。

AI Reading Hub
Product Application7

PDF难点解析:处理复杂表格、水印、印章、复选框、信息抽取等7项任务,6大能力

文章介绍Nanonets - OCR - s可处理关键信息提取、视觉问答等7项任务,具备LaTeX方程识别、图像描述等6项能力,还给出体验链接。但测试发现英文体验优于中文,模型有重复输出、幻觉严重问题。

CourseAI
算法论文8

如何改变AI研究范式?谷歌DeepResearch新方法TTD-DR原理与实现 | 原理篇

谷歌提出新的DeepResearch方法TTD - DR,它模拟人类研究范式,将Agent起草的初稿视为‘含噪声输出’,经多轮检索 - 改进使初稿成高质量终稿,还引入自进化机制,测试显示其在复杂任务上领先。

AI大模型应用实践
产品应用7

物理引擎 + 视频生成!输入一张图,让AI演给你看真实物理世界

WonderPlay将物理仿真与视频生成结合,从单张图像生成动态3D场景。它引入混合生成模拟器,形成物理求解器与视频生成器闭环。与其他方法对比,WonderPlay在多种场景和材质下表现更优。

带你学AI
开源动态8

不吹不黑,在Agent任务上,kimi 2.6确实让我忘了Claude。

Kimi K2.6发布并开源,代码和Agent能力提升。作者测试发现,它在部署Claude Code源码、网站生成、多智能体任务等方面表现出色,审美提升,思维活跃,还能复刻文档风格,开源释放了前沿编程能力。

探索AGI
算法论文8

统计可控数据合成!新框架突破大模型数据生成局限,麦吉尔大学团队推出LLMSynthor

麦吉尔大学团队提出新方法LLMSynthor,让大模型成结构感知的数据模拟器,为隐私敏感、数据稀缺场景生成不泄密的高质量替代数据。它通过结构推理、统计对齐等步骤实现,有理论保障,多场景实测效果佳。

量子位
开源动态8

超越谷歌Banana,字节联合香港中文大学等高校开源最强图像编辑生成系统DreamOmni2

香港多高校与字节跳动联合研发的DreamOmni2系统,实现图像编辑与生成领域SOTA。它用三步造出高质量数据,提出索引编码等方案,联合训练模型,实际效果超越部分商业模型,为AI创作带来新可能。

AIGC开放社区
产品应用8

GLM-5正式发布,744B参数,对标Claude

GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试中成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。

AI工程化