迭代蒸馏与增强」共找到 879 篇相关文章

产品应用7

用了60天Claude Code,我的Vibe Coding终极指南:从0到1的正确打开方式

作者分享使用Claude Code 60天的经验,用多个案例展示其将AI编程从辅助推向自主的能力,还给出Vibe Coding方法论、工作流等,提醒别被工具束缚,技术为人服务。

探索AGI
开源动态8

悟空AI Agent再进化:连斩魔搭社区SWIFT框架RCE 0day漏洞

腾讯悟空AI Agent对魔搭社区SWIFT框架开展深度安全审计,通过人机协同发现两个较难利用的RCE 0day漏洞,获官方致谢。该框架在易用性和高效性上表现出色,此次发现推动了其安全性提升。

腾讯技术工程
新闻资讯7

研究显示:AI 编程工具在经验丰富的开发者手中表现未达预期

METR研究人员对经验丰富的开源开发者开展随机对照试验,让其使用Claude 3.5和Cursor Pro等AI增强型开发工具。结果显示,AI辅助编程使任务完成时间延长19%,与预期相悖。

InfoQ
新闻资讯7

Mistral的首个强推理模型:拥抱开源,推理速度快10倍

本周二,欧洲人工智能公司 Mistral AI 发布全新大语言模型 Magistral 系列,有企业版 Magistral Medium 和 24B 参数开源版 Magistral Small。它推理强、多语言表现好,速度比竞品快 10 倍,应用于主流云平台,成本有竞争力。

机器之心
算法论文8

揭开大模型“伪遗忘”,港理工等团队:结构不变就是没忘

近年来大语言模型隐私风险受关注,机器遗忘技术应运而生。港理工等团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘不可逆遗忘’,揭示遗忘现象背后表示结构变化规律,还做了相关实验并得出核心结论。

量子位
算法论文8

统计可控数据合成!新框架突破大模型数据生成局限,麦吉尔大学团队推出LLMSynthor

麦吉尔大学团队提出新方法LLMSynthor,让大模型成结构感知的数据模拟器,为隐私敏感、数据稀缺场景生成不泄密的高质量替代数据。它通过结构推理、统计对齐等步骤实现,有理论保障,多场景实测效果佳。

量子位
新闻资讯7

谷歌发76页智能体白皮书!你的「AI替身」已上线

谷歌发布76页AI智能体白皮书,剖析其应用前景。涵盖智能体运维、评估方法,探讨多智能体架构,还介绍智能体增强检索生成及企业应用,如NotebookLM企业版、Agentspace空间企业版等。

新智元
新闻资讯8

4月30日凌晨,Meta举行首届AI开发者大会LlamaCon,推出Meta AI聊天机器人应用程序与ChatGPT竞争,发布Llama API。Meta试图强化开源模型生态系统以限制OpenAI发展,扎克伯格与微软CEO还探讨了开源闭源模型生态等内容。

华卫、核子可乐
算法论文8

TACL 综述 | 别只卷架构了——长文本模型的能力天花板,其实是数据决定的

该 TACL 综述首次从数据视角审视长上下文语言模型,指出长上下文能力本质是数据驱动。它建立分类体系,明确高质量长文数据条件,给出核心能力的数据配方与评估法,还整理数据集和基准,提出待解问题。

深度学习自然语言处理
新闻资讯8

对话景鲲:AI 产品的 All in One,是上下文的 All in One

Genspark 创始人景鲲在 AGI 舞台分享发展路径,其产品从 AI 搜索转型,现推出全功能 AI 办公套件。景鲲判断,未来大模型竞争激烈会商品化,AI 公司壁垒在于捕获用户工作上下文,实现「All in One」AI 工作空间。

Founder Park