训练数据生成」共找到 5543 篇相关文章

新闻资讯7

Anthropic 发文称自家 Claude 已经开智,网友:为了上市,不择手段?

Anthropic发布Claude内部机制新研究,介绍J-space和J-lens,称可读取模型未输出的内部概念。此研究在训练、评测和部署有潜在价值,但叙事引发争议,网友质疑是否过度包装。

AI科技评论
7

ChatGPT新功能,抢占你早上第一个打开的App

ChatGPT推出新功能Pulse,无需提问就可自动推送个性化更新。OpenAI应用程序首席执行官认为过去ChatGPT很被动,现在Pulse主动出击。不过网友质疑是广告推荐。目前该功能仅Pro用户可用。

量子位
算法论文8

单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
推荐文章7

AI Coding 流畅度模型:人机协作中的开发者角色转型与未来演进

生成式 AI 正进入软件开发流程,角色不断扩大。AI Coding Fluency 模型描述团队使用 AI 能力演进,从辅助到自主执行。AI 编程面临信任、上下文、任务设计挑战,关键在于协作方式。

phodal
算法论文8

上下文工程(Context Engineering)综述:大模型的下一个前沿

文章提出“上下文工程”学科,通过整合1400余篇论文构建“基础组件 - 系统实现”框架。它将上下文定义为动态结构化信息集合,揭示LLMs理解强于生成的矛盾,为AI研究指明方向。

深度学习自然语言处理
产品应用7

Qwen2.5VL又多一个娱乐场景,看电影讲故事

文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。

CourseAI
开源动态8

龙虾爆出漏洞,斯坦福 OpenJarvis 重新定义本地 AI Agent,附实测

OpenClaw开源项目虽火但漏洞多,安全堪忧。斯坦福发布本地优先的个人AI Agent框架OpenJarvis,其架构模块化,数据本地处理更安全,安装简单,还能让Claude Code部署,值得关注。

AGI Hunt
产品应用8

吴恩达来信:DeepLearning.AI Skill Builder工具隆重上线!

DeepLearning.AI发布Skill Builder工具,可根据用户AI项目经历给出个性化反馈和提升建议,从初学者到高级用户都适用,完全免费,还会生成总结报告,Pro会员有更详尽反馈。

DeeplearningAI
新闻资讯8

刚刚,新一届ACM博士论文奖正式公布

近日,新一届 ACM 博士论文奖公布,含一个博士论文奖和两个荣誉提名。获奖论文探讨人机协作解决心理健康问题,荣誉提名论文分别聚焦计算模型局限性及大模型数据利用。

机器之心
推荐文章7

Chroma创始人「Context Engineering」5 步杀疯全网

文章聚焦Chroma创始人提出的「Context Engineering」,指出RAG已死,上下文工程崛起,还给出实用建议,如聚焦检索、混合召回等,介绍了上下文工程包含的数据摄入、查询等内容。

CourseAI