长上下文场景」共找到 2944 篇相关文章

算法论文8

对噢!为什么LMs就不能直接输出答案+confidence呢?

当前语言模型在复杂问答任务中存在校准退化问题,本文提出RLCR方法,将概率校准融入RL训练目标,重构奖励函数,在多个数据集实验中显著降低校准误差,不损失准确性,为高风险场景AI部署奠基。

深度学习自然语言处理
8

那个刷爆全网的提示词技巧,吴恩达刚官宣:早就过时了!重磅发布2026最新提示词大师课

吴恩达发布《2026提示词工程大师课》,指出过去流行的提示词技巧已过时。课程介绍了成为AI高阶玩家的方法,如给足上下文、引导AI给出真实反馈、用渐进式大纲写作等,还提及AI知识获取、搜索及多模态能力等内容。

AI科技大本营
新闻资讯7

理想的眼镜,和李想的眼界

今年11月,李想称要让理想成具身智能领域最佳企业。一周后,理想发布AI眼镜Livis。Livis解决了轻便、续航与性能的矛盾,还利用造车积累实现资产复用。理想推它是因AI眼镜潜力大,能输出跨场景AI能力。

远川科技评论
算法论文8

万字硬核解读SAM 3:不止分割一切,它开始理解世界了

Meta的SAM 3能理解语义,实现可提示概念分割。它支持开放词汇、全实例分割等,架构有创新,数据引擎高效。评估显示其性能优异,与MLLM结合成SAM 3 Agent后推理分割能力强,但在专业领域和复杂场景有局限。

AIGC开放社区
新闻资讯7

顶模 Fable 5.1发布,到底强了多少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
新闻资讯8

OpenAI总裁底牌全交了:买下地球上所有的算力

OpenAI总裁Greg Brockman接受访谈,核心观点是世界期缺算力。他指出算力需求远未释放,H100涨价凸显供应紧张,OpenAI要全买光算力、自研芯片,还谈到价格与利润、产品形态、智能体应用及医疗领域潜力等。

AI寒武纪
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强大模型横扫全球医学考试!

百川智能发布首个循证增强医疗大模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元
产品应用7

基于OpenAPI和AI coding的上云智能体构建实践

文章介绍基于OpenAPI和AI coding构建上云智能体的实践。分析不同编程范式,结合AI coding发展与Multi - Agent问题,阐述构建方案,包括业务场景、构建方法、技术实现、当前效果及后续展望,还提及文档智能与RAG构建LLM知识库。

阿里云开发者
产品应用7

6个电子牛马替我上班,腾讯马维斯好用吗?

5月20日腾讯上线AI助手马维斯,由六个AI Agent组成。经测试,它在定时任务、搜索整理、竞品分析等场景有表现,但也存在文件操作易出错、图片识别不稳定、分析深度不足等问题。其背靠腾讯生态有渠道优势,但需提升体验促使用户留存。

芯师爷
新闻资讯8

万字实录:VLA 范式,具身智能的曙光与迷雾丨GAIR Live

2025年5月9日,雷峰网等举办“具身智能之VLA的实践与突破”线上圆桌沙龙。多位专家探讨VLA定义、起源、技术路线等,指出其面临推理、数据等瓶颈,还讨论了与强化学习结合、数据选择、提升泛化性、程任务及落地场景等问题。

AI科技评论