「人在循环中」共找到 8828 篇相关文章
从「找视频」到「产视频」:快手RaG推动推荐系统迈向完全生成时代
快手最新论文提出的 Recommendation-as-Generation(RaG),把推荐系统从「在已有视频里找答案」推进到「根据用户兴趣生成答案」,已在快手大规模广告系统中部署,带来广告收入提升。
为什么 LLM 搞不定复杂任务?ReAct 与 Reflexion 技术综述
文章指出大语言模型处理复杂任务存在事实幻觉、缺乏实时信息等问题。介绍ReAct将推理和行动结合,及Reflexion在其基础上添加评估反思机制,探讨两者结合优势,还提及未来发展方向。
DeepSeek“极你太美”bug,官方回应了
DeepSeek V3.1调用API开发时输出常现“极”字,在火山引擎、腾讯CodeBuddy等多平台出现,影响代码编译。官方称将在近版本修复,网友猜测或因数据清洗不彻底。
让大模型“边看边改”,视觉分割准确率直接上涨9% | ICML 2026
复旦、创智联合推出RSAgent,让多模态大模型通过多轮工具调用生成准确掩码,解决视觉分割难题。该工作入选ICML 2026,实验显示其在多个测试集上表现领先,还展示了从‘看图问答’到‘视觉行动’的路径。
The Batch: 879 | 谷歌必须与 AI 竞争对手共享数据
一家联邦法院裁定,谷歌须将当前搜索索引交给美国本土AI及搜索引擎对手,以打破其在网页搜索的垄断,但未采纳拆分公司请求。谷歌按条件共享数据,在其他业务仍可竞争。
微软开源2025 ICML获奖框架,终结大模型多轮对话严重缺陷
微软开源2025年ICML获奖框架CoLLabLLM,可解决大模型多轮对话缺陷。它由四大模块构成,经多轮对话模拟和奖励优化模型。在三大基准平台测试显示,能在多样任务中高效协作。
ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代
随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。
苹果向英伟达生态妥协了!MLX框架主动适配CUDA
苹果特意为端侧AI模型训练推出的MLX框架,主动增加了CUDA支持。因CUDA在AI开发领域占主导,且生态强大,苹果此举是借力英伟达生态、扩大自身影响力的战略选择,也避免侵权。
Anthropic曝光自家整套,AI原生研发手册
Anthropic 在官方博客发布两篇内部实践文章,《The AI-Native SDLC Playbook》讲 AI 承担多数编码工作时软件流程安排,《How Anthropic secures its AI-native software development lifecycle》谈流程自动化后安全体系建设。
春晚武BOT论文来了!王兴兴署名,同步开源其架构
宇树发布武BOT技术论文,王兴兴署名,同步开源OmniXtreme架构。该架构通过双阶段框架,打破学习和物理可执行性瓶颈,在高保真度与可扩展性间权衡,经测试在真实硬件上表现出色。