交互优化」共找到 1775 篇相关文章

算法论文8

以星为舵:LLM的Post-Train与Rest-Time奖励学习综述

这篇论文提出奖励信号像AI的“导航星”,引导模型优化行为。介绍奖励学习概念、来源、形式和策略,阐述其贯穿LLM生命周期的三个阶段,探讨奖励模型设计选择,还提及实际应用、挑战与未来方向。

深度学习自然语言处理
新闻资讯7

AI不会自动带来好结果

马斯克称未来劳动力成本趋近零,人人高收入、工作成爱好。但AI是存量优化,不创造新岗位。其观点有致命漏洞,如生产红利分配不公、高收入资金来源不明、忽略工作社会意义等。

newtype AI
产品应用8

Sora2不够香了!这款国产AI视频模型已经能边看边生成,生成快还互动佳

国内AI视频玩家弯道超车,百度蒸汽机(文心专精版)开卷实时流式生成。它能边看边生成,生成快还互动佳,实现生成迅速、实时交互、无限续写,重新定义AI视频生成领域。

量子位
开源动态7

DeepSeek R1/V3作者开源轻量级vLLM,1200行代码读懂大模型推理技术!

DeepSeek R1/V3作者俞星凯开源轻量级vLLM——Nano - vLLM。它有快速离线推理、代码可读、含优化套件等特性,还给出了RTX 4070等硬件和Qwen3 - 0.6B模型的基准测试配置。

PaperAgent
产品应用8

豆包「打电话」升级 Seeduplex:周围再吵,只认准你的声音

作者分享使用豆包语音通话功能体验,发现它换了新语音模型 Seeduplex。该模型是原生全双工语音大模型,解决半双工问题,在复杂场景表现出色,还介绍其技术逻辑及对行业的影响。

特工宇宙
推荐文章7

自建一个 Agent 很难吗?一语道破,万语难明

作者分享给传统研发平台接入 Agent 开发能力的经验,介绍技术选型、方案落地、系统提示词优化、知识库建设等内容,还提及工具接入、上下文管理等方面,为想自建 Agent 的人提供启发。

阿里云开发者
产品应用8

通用级PixVerse P1的技术突破,揣着进入平行世界的密码

PixVerse R1 突然上线,带来「即时响应、即看即创」新体验。它是全球首个支持最高 1080P 分辨率通用实时世界模型,实现从「静态输出」到「实时交互」跨越,本文将解析其技术突破。

机器之心
产品应用8

登顶SuperCLUE DeepSearch,openPangu-R-72B深度搜索能力跃升

近日 SuperCLUE 发布 11 月 DeepSearch 评测报告,国产大模型 openPangu - R - 72B 名列第一。它采用 MoE 架构平衡效率与性能,经预训练技术优化和 DeepSearch 专项突破,彰显国产算力与大模型研发融合成效。

机器之心
产品应用8

基于 Elasticsearch 创建企业 AI 搜索应用实践

Elastic 中国社区首席布道师刘晓国,分享基于 Elasticsearch 创建企业 AI 搜索应用实践,介绍其向量搜索技术及 RAG 应用开发,还提及智能时代搜索需求变化、混合搜索优势及 Elasticsearch 优化改进等内容。

InfoQ
产品应用8

“10x Cursor”开发体验, Claude Code 如何带来 AI Coding 的 L4 时刻?|Best Ideas

文章聚焦 Claude Code,探讨其在 AI Coding 领域的表现。开发者因成本低、效率高、异步开发等优势迁移至此。虽其 CLI 形态爆火,但 GUI 才是未来。Claude Code 达 L4 级别,也指出当前 AI coding 产品不足与未来机会。

海外独角兽