「AI模型性能」共找到 14034 篇相关文章

产品应用7

AI又来带货了!字节推出DreamActor-H1自动对齐手势和商品

在电商和数字营销领域,现有框架呈现效果不佳。字节推出DreamActor - H1框架,基于扩散变换器,集成Seaweed - 7B模型,能生成高保真人机交互视频,有效果突破但也存在局限。

带你学AI
产品应用8

刚刚,MiniMax来承包你的桌面了

2026 年 Agent 赛道竞争白热化,市场分化。国产 AI 大模型独角兽 MiniMax 1 月 20 日推出第二代智能体产品 MiniMax Agent 2.0,从产品形态和能力分布深度重构,是‘AI 原生工作台’,实测表现出色。

机器之心
算法论文7

管你模型多大,250份有毒文档统统放倒,Anthropic:LLM比想象中脆弱

Anthropic等联合研究打破传统观念,只需250份恶意文档就能在参数规模从6亿到130亿的LLM中植入后门,且与模型规模及训练数据量无关。研究还测试了特定后门攻击,评估了多种训练配置。

机器之心
产品应用8

拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」

Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。

AI科技评论
产品应用7

P图老本事搭上了对话框,美图这AI Agent到底香不香?

本文对美图AI Agent RoboNeo进行实测。它web端操作简单,生图和p图功能丰富,拆分图层功能好用,工作流能辅助创作。不过它生成速度慢,视频生成有画面逻辑、文字生成等问题。其开发节奏快。

量子位
算法论文8

NeurIPS 2025 Best Paper | 扩散模型不为人知的“时间差”:为什么先学会创作,后学会抄袭?

深度学习中,扩散模型能生成新图像且抗过拟合。巴黎高师和博科尼大学研究团队论文指出,这源于隐含的动力学正则化,训练分两阶段,数据量增加会拉开‘泛化窗口’,还给出数学解释。

深度学习自然语言处理
开源动态8

3.9K star 惊艳!!媲美IDM,跨平台,AI加速,这届高中生牛逼了!

Ghost-Downloader-3是高中生用Python打造的跨平台多线程下载器,初衷是帮B站UP主整合资源。现具AI加速等功能,在GitHub获3.9K星,安装简单,未来还将添加磁力和BT下载。

开源先锋
开源动态7

专访|两位华人主导创办,Jeff Dean参投,伯克利开源项目SkyPilot转型初创

前沿模型团队算力瓶颈从不足变为分散,开源AI算力调度项目SkyPilot应运而生。7月末,它从高校走出成为初创公司,完成2000万美元种子轮融资。其免费版与商业版各有侧重,切入AI编排赛道潜力大。

DeepTech深科技
算法论文7

deepseek-V4算法工程技术深入浅出

文章围绕deepseek V4技术报告展开,指出当前大模型训练不充分,介绍了算法层面如混合注意力机制、模型结构优化、优化器等,工程层面如细粒度专家并行、算子内核开发等,以及后训练的范式转变和领域专家网络蒸馏等内容。

Agent的潜意识
新闻资讯8

OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家计划在瞄准谁?

今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部大模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。大模型下半场比拼基础研究,构建评测基准很重要。

机器之心