「弱监督动态场景图生成」共找到 2354 篇相关文章
4个月11万用户、Claude Code成了,Dogfooding该被AI公司重视起来了
Dogfooding(内部试用)应被AI创业公司重视。Anthropic推出的Claude Code源于内部工具孵化,经内部使用和场景验证后发布,四个多月获11万开发者用户,其成功说明深度内部试用是竞争优势。
刚刚,OpenAI发布CoT监控,增强AI Agent自主能力
今天凌晨,OpenAI发布思维链(CoT)监控技术论文,用于监督AI Agent,增强其自主性。思维链监控可调试故障、合规审计,是构建安全透明AI的蓝图,文中还提及CoT监控必要性及有效方法。
NVIDIA提出小型LLM才是未来,并将重塑Agentic AI
人工智能代理快速渗透企业场景,但当前系统依赖大型语言模型,存在经济成本和效率错配痛点。NVIDIA团队提出小型语言模型才是代理AI未来,论证其能力、经济性和操作适配性优势,并给出迁移路径。
一种基于滑动层合并的高效深度修剪大模型的方法
文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。
阿里云客服Agent业务提效实践:灵活可控的落地方法论
阿里云算法专家姜剑介绍了“阿里云服务领域 Agent 平台”及业务提效方法论。阐述 Agent 技术本质、模式,分析其给客服领域带来的价值,指出阿里云客服痛点,提出解决设计问题的方法,展示平台设计与落地成果。
国产AI眼镜现状,这里有份沙龙实录|量子位AI沙龙
量子位举办AI眼镜沙龙,小米、百度等专家指出行业关键挑战刚开始。如续航与常在线矛盾,国内厂商易走错路等。还探讨了技术方案、未来趋势、应用场景等,也有圆桌对话分享挑战与机遇。
香港科技大学、Manycor开源空间大模型,超3000颗星
香港科技大学、Manycore联合开源空间大模型SpatialLM,用于处理3D点云数据。它结合点云特征提取、对齐和语言生成,实现高效转换。研究团队经多种尝试选定基于点的方法及Sonata编码器,还选Qwen2.5 - 0.5B为基础模型。
万字长文!大模型(LLM)推理优化技术总结(非常详细)
文章聚焦大模型推理优化技术,介绍推理过程分预填充与解码阶段,还阐述模型并行、注意力机制优化、模型优化及服务技术等,如多查询注意力减少内存,FlashAttention 优化计算顺序。
多模态模型挑战北京杭州地铁图!o3成绩显著,但跟人类有差距
近年来,多模态大模型在多种场景取得进展,但能否‘看懂图’存疑。西湖大学等团队提出评测基准ReasonMap,评估模型在地铁图理解中的能力,发现主流模型有瓶颈,闭源模型虽优但仍逊于人类。
突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智能体新范式!
在信息爆炸时代,传统检索技术缺乏动态决策能力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。