「AI 写代码」共找到 10568 篇相关文章

算法论文8

华为发布如何利用RL训练强大的Deep Research Agent综述!

华为技术团队发布综述论文,首次系统性梳理利用强化学习(RL)训练强大的深度研究代理。论文指出传统SFT和DPO方法有局限,RL优势明显,还在数据构建、算法设计等方面给出进展与路线图。

深度学习自然语言处理
产品应用8

文心X1.1发布!这三大能力突出,一手实测在此

百度深度思考模型文心X1.1升级上线,在事实性、指令遵循、智能体等能力显著提升,实测表现佳。WAVE SUMMIT 2025大会还发布开源模型ERNIE - 4.5 - 21B - A3B - Thinking等,飞桨框架也升级到v3.2。

量子位
算法论文7

谷歌:Embedding检索存在根本理论局限,Sparse、Graph才是未来?

近年来稠密向量检索广泛应用,社区认为embedding能‘包打一切’,但谷歌DeepMind从理论与实验指出其存在根本局限。相关实验代码和数据已开源,还给出替代方案。

PaperAgent
新闻资讯7

刚刚,OpenAI任命新印裔CTO!11亿美金连公司打包收购,接管ChatGPT产品核心

OpenAI斥资11亿美金收购实验平台Statsig,其CEO Vijaye Raji成应用部门新CTO,将负责ChatGPT等产品工程。同时启动「OpenAI for Science」项目,打造AI驱动的科学发现平台。

新智元
新闻资讯7

马斯克收购OpenAI新计划实锤了:找小扎筹千亿美元,果然敌人的敌人就是朋友…

今年2月马斯克为收购OpenAI找扎克伯格筹资974亿美元,想拉其入伙,曾有激烈冲突的二人放下前嫌,但Meta婉拒。小扎忙于组建“亿元俱乐部”,OpenAI则因人才流失致HR负责人离职。

量子位
推荐文章7

深刻理解Token:大语言模型(LLM)是如何看待这世界?

文章指出在大语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
新闻资讯7

马斯克痛失xAI大将!Grok 4缔造者突然离职,长文曝最燃创业内幕

xAI联创Igor Babuschkin官宣离职创业,他回顾在xAI两年,团队120天打造超算Colossus,训出Grok 4。他将创办风险投资公司,马斯克致谢,其离职让xAI未来发布少关键一员。

新智元
产品应用7

用了60天Claude Code,我的Vibe Coding终极指南:从0到1的正确打开方式

作者分享使用Claude Code 60天的经验,用多个案例展示其将AI编程从辅助推向自主的能力,还给出Vibe Coding方法论、工作流等,提醒别被工具束缚,技术为人服务。

探索AGI
产品应用7

用 Ollama 本地运行 OpenAI gpt-oss 官方完整教程

OpenAI出教程教用Ollama本地部署gpt-oss-20b或gpt-oss-120b,可实现离线对话、API调用等。介绍模型版本、硬件要求、安装设置,还提及对话、API使用、工具调用、与Agents SDK集成等内容。

AI工程化
开源动态8

通义实验室大火的 WebAgent 续作:全开源模型方案超过GPT4.1 , 收获开源SOTA

WebAgent续作《WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization》提出对information-seeking任务形式化建模,设计训练数据合成方法,全开源模型方案在GAIA评测获SOTA表现,还补足了训练数据不足问题。

机器之心