「复杂文档处理」共找到 1959 篇相关文章
快手可灵也吃上了香蕉,一通离谱prompt测试,好好玩要爆了
ChatGPT发布三周年,快手可灵AI视频「O1模型」登场,号称“全球首个统一多模态视频模型”。实测显示它能一站式搞定视频修改、镜头延展等操作,还推出了图片O1模型,在图片生成方面表现出色。
与Banana Pro过过招,国产Libcom图像合成工作台开启Labubu漫游记
2025年AIGC热度再创新高,通用图像编辑大模型虽功能强大,但在细分领域有不足。上海交通大学牛力团队推出并升级了Libcom图像合成工作台,与Nano Banana Pro对比,其在图像合成上表现更稳定。
GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则
新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。
团队授权:分散化的架构决策
文章以黏菌创建网络为隐喻,探讨软件团队去中心化架构决策。介绍转型历程,包括重组团队、建立建议流程、创建上下文图等,阐述各环节作用、挑战与收益,强调其能提升决策质量与团队参与度。
Nature公开谷歌IMO金牌模型技术细节!核心团队仅10人,一年给AI编出8000万道数学题训练
谷歌DeepMind的IMO金牌模型AlphaProof技术细节公开。团队规模小,核心成员是IMO金牌得主。它把数学证明当游戏,用30亿参数模型和改进树搜索算法。训练难题靠自动形式化解决,赛场用TTRL突破,已开放使用。
更会聊天、主打情绪价值,OpenAI 发布 GPT-5.1
今天凌晨,ChatGPT 模型升级为 GPT-5.1,官方主打更智能、更具对话性。它有 GPT-5.1 Instant 和 GPT-5.1 Thinking 两个子模型,本周内逐步向所有用户免费开放。升级重点在模型能力和个性化设置。
ACM MM 2025 Oral | 新加坡国立大学提出FractalForensics,基于分形水印的主动深度伪造检测与定位
近些年来,深度伪造主动防御受关注,但现有方法有鲁棒性不稳定等问题。新加坡国立大学等团队提出 FractalForensics 方法,基于分形水印实现主动深度伪造检测与定位,实验效果良好。
最具争议性研究:大模型中间层输出可 100% 反推原始输入
意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射性,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。
独家丨MiniMax 高级研究总监钟怡然已于半年前离职
AI 科技评论独家获悉,MiniMax 高级研究总监钟怡然已离职,去向未公开。他曾主导设计 MiniMax - 01,该模型在超长上下文处理能力上表现突出,走出独特架构创新与效率优化路径。
Visual Studio 正式支持 MCP
2025年8月微软宣布模型上下文协议(MCP)在Visual Studio正式可用,为AI智能体与外部工具连接提供一致协议。开发人员可配置文件连接,管理员能管理使用。但存在限制和安全风险。