「模型架构升级」共找到 9051 篇相关文章
让思考更准更长!强化学习新算法FIPO来了
阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。
Sam Altman:超级智能近在眼前!OpenAI官方13页蓝图引爆海外社区
OpenAI CEO Sam Altman 在 Axios 采访中称超级人工智能到来比预期快,社会需新契约管理。OpenAI 提出‘智能时代的产业政策’,含设公共财富基金、征机器人税等提案,还谈到下一代大模型。
DeepSeek 硬核开源 DeepSeek-OCR-2!弃用 CLIP 改用 Qwen,创新视觉因果流!
昨天开源社区热闹非凡,Kimi 发布 K2.5,DeepSeek 则推出 DeepSeek - OCR - 2,用 LLM 架构替换传统 CLIP 视觉编码器。它核心创新是视觉因果流,能智能规划阅读路径,性能高效且全量开源。
这几个开源项目火起来啦,抓紧收藏哟起来!!!
本文介绍三个热门开源项目。KnowNote 是本地优先的 AI 知识笔记工具,是 Google NotebookLM 开源替代方案;Remotion 让开发者用 React 技术栈制作视频;Superpowers 可让 AI 编程助手升级为智能开发伙伴。
阿里 Qwen3-TTS 全新上线!支持9种方言+49种音色,连天津味儿都拿捏了!
阿里通义团队上新 Qwen3-TTS 文本转语音模型,主打拟人语音表达、丰富音色体系与多语言多方言能力。有 49 种高保真音色,支持 10 种语言、9 种方言,还能智能调节语速和韵律。
自主金融研究智能体
Dexter是自主金融研究智能体,会思考、计划和学习。它能将复杂金融问题转化为研究计划,利用实时数据执行任务、自我验证。介绍了其核心能力、安装使用方法、架构、项目结构、配置等。
Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求
Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。
被误解的谷歌和百度。
文章指出大模型竞争短期拼产品体验,长期靠系统化落地能力。谷歌和百度虽被误解,但前者在I/O大会展示AI布局,后者营收利润双增,两家都构建生态,在AI下半场迎头赶上。
新晋顶流Agent颠覆设计师!Lovart一手实测来了:是该刷屏爆火
新晋顶流Agent Lovart火爆全网,可一句话搞定专业视觉设计,支持二次编辑。量子位实测其设计能力强,背后是多模型融合调度。它定位人机协作,适合中小企业,官网可申请内测。
苏妈和李飞飞炸场CES!AMD AI全栈野心显露:从云端到个人PC,AI芯片性能四年要飙1000倍
今年 CES 上 AMD 专场演讲亮点多。苏姿丰称未来五年50亿人每天用 AI;李飞飞和她探讨空间智能与世界模型;Helios 平台受关注,MI455 GPU 解决内存墙;Ryzen AI 推动 AI 下放到本地。