多尺度生成」共找到 5698 篇相关文章

开源动态8

阿里开源长文本深度思考模型!渐进式强化学习破解长文本训练难题,登HuggingFace热榜

阿里开源长文本深度思考模型QwenLong - L1,登上HuggingFace热门论文第二。它解决了长文本强化学习训练难题,通过渐进式上下文扩展训练,在基准测试中表现出色,还探讨了SFT和RL作用。

量子位
新闻资讯7

刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

DeepSeek在官方API文档给出thinking mode和tool call结合样例,把模型中间思考过程成Agent系统需管理部分。关键字段`reasoning_content`从调试信息成协议流程一部分,影响状态管理、模型适配等。

AI科技评论
新闻资讯7

OpenAI世纪诉讼,马斯克输了!

马斯克诉OpenAI 1500亿美元案件,陪审团90分钟全票驳回,原因是诉讼时效已过。虽未审理实质指控,但庭审揭开OpenAI隐秘运作。此判决为OpenAI IPO扫清障碍,双方后续还有起诉讼待决。

新智元
产品应用8

原生Agent杀入画布!一站式搞定专业创作,全程可控、不抽卡

国内RunningHub平台推出原生AI智能体全能内容创作平台RHTV,它能一站式搞定专业创作,流程可控。实测显示,它能编排短剧、生成商用物料,还内置影视级工具,且依托庞大生态,能力无上限。

量子位
开源动态8

OpenClaw 3.24发布:彻底解决最重要的Skills安装障碍!

OpenClaw 3.24 发布,改动显著。Skills 安装更顺滑,系统自动检测依赖;控制台界面大改,侧边栏更易用;修复媒体文件访问漏洞;Microsoft Teams 支持升级;还修了平台群聊 Bug,新增 API 端点,提升 RAG 兼容性。

新智元
新闻资讯7

挺搞笑,MiniMax模型就是不认识「马嘉祺」

网友发现 MiniMax 模型不认识「马嘉祺」,不同接口和平台均能稳定复现。这或因训练数据清洗和分布问题,使特定词汇生成异常。论文指出 tokenizer 机制缺陷或致模型异常,问题不会随参数规模增大消失。

机器之心
新闻资讯7

OpenClaw中国行北京站落幕,3万人围观养虾,本周12城活动继续

2026年3月21日,OpenClaw中国行首站北京站举办,近200名开发者参与,直播间3万人围观。活动上开发者30分钟可跑通AI应用,位嘉宾分享使用经验,本周末将在12城继续开展。

AI前线
新闻资讯7

4680电池的大饼,马斯克不想画了

特斯拉死磕4680电池五年后低调退堂鼓。韩国L&F供货合同金额减值超99%,几乎等同项目黄了。原因或与Cybertruck销量不佳有关,且4680电池在掺硅负极和干法电极上进展缓慢。

远川科技评论
算法论文8

LLM协作告别文本形式:直接“脑对脑”,Cache-to-Cache实现语义瞬时传输

现有LLM系统依赖文本通信,效率低且易失真。论文提出Cache - to - Cache(C2C)范式,让LLMs通过KV - Cache“脑对脑”交流,实现高效精准语义传输,在类任务中提升性能与效率。

深度学习自然语言处理
产品应用7

用Cursor做UI,最有效的两个方法

作者黄益贺分享用Cursor做UI的两个方法,免费法是用Gemini等生成JSON配置贴到Cursor;付费法是API调用Vercel的v0模型。还提及添加动画提升体验及前端UI开发工具箱。

newtype AI