「复杂文档处理」共找到 1958 篇相关文章
好看不等于会交互!阿里发布基于交互的世界模型基准
阿里等联合推出 Omni - WorldBench 评估框架,指出多数高颜值 AI 视频在物理规律和交互逻辑上有缺陷。该框架含提示词套件和量化评估框架,对 18 款模型测评,为 4D 世界模型研发指明方向。
26.7K 标星!GitHub 高分教程 Learn Claude Code:12 节课带你手搓一个 Cursor!
Learn Claude Code是shareAI - lab开源教学项目,目标是让人理解AI编程Agent工作原理。它有12节课,每节加一个机制,逻辑清晰。配交互式Web平台,文档‘心智模型优先’,还提供后续项目助知识落地。
豆包上可以体验 Seedance 2.0 了,我已经试了一下。
Seedance 2.0是字节自研视频生成模型,已接入豆包App、电脑端和网页版。支持文生视频、图生视频、分身视频等,动作自然、镜头连贯,生成质量高,还解决了创作者出镜难题,操作也简单。
刚刚,MiniMax来承包你的桌面了
2026 年 Agent 赛道竞争白热化,市场分化。国产 AI 大模型独角兽 MiniMax 1 月 20 日推出第二代智能体产品 MiniMax Agent 2.0,从产品形态和能力分布深度重构,是‘AI 原生工作台’,实测表现出色。
让AI像人类画家一样边画边想,港中文&美团让模型「走一步看一步」
在文生图和视频生成领域,现有模型处理复杂任务常出错。港中文和美团团队提出TwiG范式,将视觉生成拆解为“生成-思考-再生成”循环,经实验验证有效,有望拓展到更多领域。
别让Nano Banana骗了!混合方案让头像生成成功率从0到100%
作者用Nano banana更新头像时发现其生成中文能力差,提出将AI画图与HTML编程结合的方案。HTML搞定确定性、成本低部分,AI画图负责复杂、创意性高部分,还给出使用方法及多种头像加字设计方案。
全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑大模型
中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲大模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。
Oxlint 1.0 稳定版发布:基于 Rust 的 JavaScript 静态检查器
Oxlint是基于Rust的JavaScript和TypeScript静态检查器,其1.0稳定版发布。它有快速检测、规则覆盖广等特点,性能比ESLint高50 - 100倍,能处理多文件规则,开发者反馈积极。
仅10行代码,轻松打通你的AI应用与DB:谷歌开源数据库MCP,Star突破4.6k
谷歌开源面向数据库的MCP Toolbox,位于应用编排框架和数据库间,处理连接池等复杂问题,简化工具管理。它能助开发者构建让智能体访问数据库的Gen AI工具,有开发简便等优势。
苹果在WWDC提到的本地模型,这家公司把它提速了220倍
苹果在WWDC开放本地语言模型API,让iPhone等有了“AI大脑”,但开发者面临模型运行慢问题。国产团队面壁智能发布MiniCPM 4.0,端侧处理长文本提速惊人,从多层面创新实现,还补上推理框架缺口。