全注意力模型」共找到 8819 篇相关文章

7

Google发布"Nano Banana"图像生成模型,号称球第一

Google推出新图像生成和编辑功能,社区称其为‘Nano Banana’,号称‘世界第一’且免费开放。它有风格转换、背景编辑等亮点,用户反馈整体积极,但也存在API限制等问题,与对手有差距也有优势。

AI工程化
产品应用7

模型系统提示词逆向(1)—— ChatGPT

文章介绍大模型系统提示词逆向原理,利用‘认知冲突’让AI意外‘泄密’。还给出逆向提示词示例,并展示了ChatGPT系统提示词原文及翻译,包含其角色设定、工具使用规则等内容。

AI Reading Hub
产品应用7

英伟达用NIM + NV-Tesseract模型,提高芯片生产良率

芯片制造良率控制难题待解,传统方法各有局限。英伟达推出NV - Tesseract模型家族和NIM推理微服务,二者结合用于半导体晶圆厂生产,可实时发现问题、预测故障,降低成本,为制造打开新大门。

AIGC开放社区
开源动态7

AgentIF-OneDay 发布,评估场景长时复杂任务

红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。

特工宇宙
算法论文8

人类记忆 vs 大模型记忆,到底差在哪?

这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人类“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“类人情景记忆”AI,还剖析差异并给出评估方法和展望。

深度学习自然语言处理
算法论文8

不玩Harness,卷Model,Meta说:模型即计算机

当下AI圈热捧Harness Engineering,Anthropic让Harness从概念成产品,众多企业纷纷入局。但Meta反其道而行,发布Muse Spark模型,还联合提出神经计算机领域,其论文对相关概念做了介绍并展示实验结果。

PaperAgent
推荐文章7

2025,大模型文档解析(OCR)年终盘点

2025年6月以来文档解析方法快速增长,有10余种。按“技术路线 + 工程形态”可归为4大类:传统级联流水线、轻量多模态两段式、通用多模态大模型一段式、轻量多模态一段式,各有优劣,4条路线覆盖所有OCR落地场景。

PaperAgent
产品应用8

网实测Gemini Omni!一句话改视频,草图变大片

谷歌在Google I/O大会推出Gemini Omni,它结合推理与生成能力,在多方面有重大飞跃,能生成逼真视频等。它打破命名体系,训练目标不同,有涌现能力,谷歌还为其设置限制。

新智元
开源动态8

SimpleTIR:让大模型“边写代码边思考”不再崩溃

SimpleTIR可解决多轮工具调用中训练崩溃问题。作者指出崩溃原因是分布偏移、低概率token链式雪崩和梯度爆炸。它采用void turn过滤,掐断崩溃链路,训练稳定,还催生多样推理行为,且工程友好已开源。

AI科技评论
新闻资讯8

黄仁勋凌晨炸场:6G、量子计算、物理AI、机器人、自动驾驶来了!AI芯片营收已达3.5万亿|2025GTC超指南

美东时间10月27日英伟达GTC大会开幕,黄仁勋演讲涉及6G、量子计算等热词。官宣与诺基亚合作建6G AI平台,还投资10亿美元。此外,英伟达AI芯片订单总额达5000亿美元,股价创新高。黄仁勋还阐述AI是新计算方式。

AI前线