「生成式智能体」共找到 5649 篇相关文章

算法论文7

1万tokens是检验长文本的新基准,超过后18款大模型集体失智

Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。

量子位
产品应用7

B站下场自研AI配音!纯正美音版甄嬛传流出,再不用看小红书学英语了(Doge)

B站发布TTS模型IndexTTS2,亮点是实现时长控制时再现符合Prompt的情感特征,支持两种生成方式,经测试多项指标达SOTA。它由三核心模块组成,还可能是代号H的AI创作工具一环。

量子位
算法论文8

【医学影像分割】UN-SAM:一种高效且通用的细胞核分割模型

文章提出UN - SAM框架解决现有SAM在医学影像分割依赖人工标注、跨域泛化不足问题。它含三大模块,能自动生成提示、增强特征判别力和跨域分割精度,实验显示其在多数据集表现优,代码已开源。

机器学习AI算法工程
产品应用7

如何让 AI 成为你的编程搭档?一次真实重构告诉你答案

文章介绍编程工具Cursor,它是基于VS Code、深度集成AI的智能代码编辑器,有多种模式,能力强但有局限。作者分享用其完成重构需求的过程、经验,还提及使用中踩坑及应对方案,最后总结提效成果。

阿里云开发者
算法论文8

8B模型可以超过GPT-4o!并行KV Cache压缩支持的128K长度外推方法ParallelComp

大模型长文本推理存在瓶颈,作者提出 ParallelComp 方案。它有并行 Attention 分块、KV 缓存智能淘汰与注意力偏差校准三大创新,能让 8B 模型性能达 GPT - 4o 的 91.17%,特定任务超 GPT - 4o。

机器之心
产品应用7

比修驴蹄还魔性!谷歌这7段纸片动画,看完焦虑没了,第2支直接封神

全球网友爱刷解压视频,谷歌Gemini下场做带提示词的解压视频。它推出7段纸艺动画,包括火烈鸟起舞、圣托里尼落日等,靠高精准提示生成等打造,拓展想象边界,是通往美学与治愈的桥梁。

新智元
产品应用8

Midjourney正式推出 V1 视频模型:美学细节无敌

Midjourney推出视频生成模型V1,主打高性价比、易上手。采用“图像转视频”工作方式,有两种动画和运动幅度设置。入门价每月10美元,任务成本低,未来一月或调价格,目标是实现实时交互开放世界模拟系统。

AI寒武纪
开源动态8

MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
产品应用8

员工每天花1000美元也要用ClaudeCode!创始人:太贵了,大公司专属,但它比 Cursor 猛!

Claude Code处理大型代码库能力强,但价格贵,有用户称能力超Cursor。其创始人分享设计理念、使用方法等,还提到它基于Claude 4系列模型有新变化,可在GitHub等场景用,未来会拓展工具协同和小任务处理。

AI前线
新闻资讯7

叫板 OpenAI Sora?Manus 推出文生视频服务,计划向所有用户开放

近日,Manus AI 推出文本转视频生成服务,支持单条提示完成视频制作,目前供部分订阅用户抢先体验,计划向所有用户开放,对标 OpenAI Sora 等竞品。其母公司获投资,还与微软合作,系统有独特优势。

AI前线