「思考预算」共找到 708 篇相关文章
测评豆包1.6:我用它开发了一个“聪明的旅行策划Agent”
作者对豆包1.6进行测评,用其构建旅行策划Agent。豆包1.6推理强、有自适应思考模式且计价创新。作者实操构建旅行Agent,结合MCP完成任务,虽有不足但超预期,国内Agent开发生态已成熟。
李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了
本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。
姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人
腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升Coding和Agent能力。其加持下,元宝大升级,能完成办公、生活等多场景任务。
Claude 终于能“看”视频了!这个开源项目让我刷视频效率翻倍
平时找视频信息效率低,而开源项目让Claude等大模型 “看懂” 视频,能提取画面、音频并理解内容。介绍了其工作原理、帧预算、去重、细节模式等,安装使用门槛低,还给出了应用场景和项目地址。
写在 Claude Design 发布之后:如果明天巨头做掉了你的核心功能,你该怎么办?
Anthropic 发布 Claude Design,可从提示词生成设计稿等,让 Figma 市值蒸发。这引发对 AI 应用层产品的思考,当基础模型厂商收回能力,靠能力缺口的产品将失重,应用层需从工作流、数据等找机会。
刚刚,豆包「成精」了!一夜告别机械感,上亿人手机全量上线
字节跳动Seed团队发布原生全双工语音大模型Seeduplex,已在豆包App全量上线。它边听边说、懂思考停顿、抗干扰强,解决了精准抗干扰与动态判停难题,工程上也有突破,提升了交互体验。
小米在AI方向有了大动作,但AI不该是资本掩盖信息的手段。
今年下半年小米MiMo团队陆续开源多个模型,或因年初挖来技术天才罗福莉。新开源MiMo - V2 - Flash模型,总参数量309B。但小米AI对外服务网站搜自家产品舆论无果,引发对AI应坦诚审慎的思考。
32倍加速,58秒搞定720p视频!字节发布离散自回归框架,统一视觉生成和长视频生成
字节发布InfinityStar框架,将5秒720p视频生成时间从30多分钟缩至58秒,还支持多样任务。它基于对视频本质思考设计时空金字塔模型,将时空分离,通过多项技术优化,性能表现出色,不过也存在一些技术局限。
为 120 个 AI 项目做增长,矩阵魔方叶晨曦:优秀的增长团队,不能去「爱」自己的产品
叶晨曦带着近10亿营销经验回归AI赛道,分享AI GTM底层逻辑。他指出AI营销缺人,窗口期仅三个月;还谈到找差异化、破圈、营销预算等要点,强调创始人要身先士卒,职业创业者应“失去爱产品的能力”。
Palantir 创始工程师深度分享:FDE 模式是 Agent 时代的 PMF 范式
本文编译前 Palantir 高管 Bob McGrew 对 FDE 模式的思考。FDE 团队填补产品与客户需求差距,交付有价值成果。在 AI Agent 时代,因产品需大量探索且要从企业内实践出发,FDE 或成创业公司新范式。