「学术分享会」共找到 2634 篇相关文章
AI正在淘汰“中间层”!昆仑万维方汉:要么冲进前10%,要么学会“向下兼容”
InfoQ专访昆仑万维方汉,他认为AI将推动“智能化”,是全面提升行业效率的“催化剂”,会淘汰“中间层”从业者。企业应快速试错,出海要选好市场、做好本地化。此外还探讨了开源、AI应用等话题。
Claude Opus 4.5 发布,我又把 Claude Max 续回来了
Claude Opus 4.5发布,价格相比Opus 4.1暴跌至1/3,收获全面好评。作者又续了Claude Max,还分享了几个Coding Agent使用感受,最后发布招人信息。
Anthropic:这样构建Agent,性能提升90%!
Anthropic分享从0到1构建多智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货多,涵盖架构设计、Prompt工程等。多智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务。
一招缓解LLM偏科!调整训练集组成,“秘方”在此 | 上交大&上海AI Lab等
上海交大和上海AI Lab联合团队提出IDEAL方法,可提升LLM综合性能。研究发现SFT阶段数据数量非关键,配比不当会加剧模型“偏科”。以Llama3.1 8B测试,IDEAL能提升代码能力,还指导了超参数选取。
Patreon 年度回顾中的架构经验
2025年Patreon工程团队在为超千万付费会员推新功能时重建底层设施。其年度回顾详述12个项目,提炼韧性迁移、数据模型重构、分布式系统一致性权衡三大架构主题,还分享多项目实操经验。
即将开源 | 阿里云Tair KVCache Manager:企业级全局 KVCache 管理服务的架构设计与实现
阿里云Tair KVCache团队联合多团队将开源Tair KVCache Manager,介绍其架构设计与实现。该服务应对Agentic AI下KVCache存储挑战,解决传统模式难题,具备企业级管理能力,后续还会完善多方面功能。
英伟达自毁CUDA门槛!15行Python写GPU内核,性能匹敌200行C++
英伟达发布CUDA 13.1,称是自2006年诞生以来最大进步。推出CUDA Tile编程模型,能用15行Python代码实现200行CUDA C++代码性能。芯片界传奇Jim Keller质疑其会终结CUDA“护城河”。
单日渲染100万帧,成本仅要20元:影石发布全球首个全景仿真平台AirSim 360!
影石Insta360的AI研究院成立不到半年成果颇丰,在顶会连中4篇论文,还开源三项核心成果,包括高保真物理仿真平台AirSim360、全景度量深度基础模型DAP、全景文生图世界模型DiT360,直击行业痛点。
AI根本守不住秘密!不依靠大模型的输出过滤才是铜墙铁壁
开发者常把秘密放系统提示词,以为安全。Swept AI和密西根大学团队测试发现,攻击者不断尝试,AI会泄露秘密。多种依赖大模型的防御方案失败,只有输出过滤能零泄露。
大模型可否胸有成竹?探索LLM推理与自信心的关系 | 直播预约
本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。