「生成式引擎优化」共找到 3506 篇相关文章
独家丨MiniMax 高级研究总监钟怡然已于半年前离职
AI 科技评论独家获悉,MiniMax 高级研究总监钟怡然已离职,去向未公开。他曾主导设计 MiniMax - 01,该模型在超长上下文处理能力上表现突出,走出独特架构创新与效率优化路径。
推理效率狂飙60倍:DiDi-Instruct让扩散大模型16步超越千步GPT
普渡大学等研究者提出 DiDi-Instruct 后训练方法,可将扩散大语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为大语言模型落地提供新方案。
论文秒变PPT!西湖大学AGI Lab推出Auto-Slides,科研汇报难度骤降
西湖大学AGI Lab推出Auto - Slides,输入论文PDF可自动生成演示文稿,支持自然语言交互修改。它采用多智能体协作框架,经实验验证优势明显,有望用于学术会议等场景,助力知识传递。
Anthropic、Thinking Machines Lab论文曝光:30万次压力测试揭示AI规范缺陷
Anthropic和Thinking Machines Lab等机构研究人员提出模型规范压力测试法,基于细粒度价值体系生成超30万个查询场景,分析12个前沿大模型回答,揭示模型规范存在原则冲突、解释歧义等缺陷。
浅谈上下文工程|从 Claude Code 、Manus 和 Kiro 看提示工程到上下文工程的转变
文章围绕上下文工程展开,介绍其概念、组成与提示工程区别,通过演示说明价值。还分析业界产品实践,如LangChain管理方法、Claude Code架构机制、Manus优化实践、Kiro开发模式,最后展望环境工程。
让LLM扔块石头,它居然造了个投石机
港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。
Rex-Omni:用 3B 模型颠覆目标检测
长期目标检测依赖传统坐标回归模型,MLLMs方法存在不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,在零样本测试中表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。
重磅!OpenAI官宣自研AI芯片:垂直整合要彻底摆脱英伟达,联手博通部署10吉瓦算力
OpenAI与博通达成深度战略合作伙伴关系,共同设计和制造AI芯片与计算系统,合作已秘密进行约18个月,目标是2026年底部署10吉瓦算力,还在用模型探索芯片设计新方法。
Qoder + ADB Supabase :5分钟GET超火AI手办生图APP
本文介绍如何用Qoder、阿里云ADB Supabase和通义千问图像编辑模型,快速搭建AI手办生图Flutter移动端应用,无需自建传统后端,涵盖思路、环境准备、各环节配置及流程等内容。
真正的AI竞争力,藏在大模型“后训练”这一步
当全球聚焦基座模型参数竞赛时,后训练变革正悄然发生。产业共识是,大模型后训练是AI落地产业必经之路。后训练技术从SFT演进至强化学习范式,企业应用也有了从技术到商业价值的完整链路。