代码能力」共找到 4471 篇相关文章

算法论文8

NeurIPS 2025 | ARGRE框架实现高效LLM解毒:自回归奖励引导,安全对齐更快、更准、更轻

北航等机构研究提出自回归奖励引导表征编辑(ARGRE)框架,在LLM潜在表征空间可视化毒性变化路径,实现测试阶段高效“解毒”。实验显示其降低毒性、缩短推理时间,不影响模型能力,优于基线方法。

机器之心
新闻资讯7

OpenAI以为GPT-5搞出了数学大新闻,结果…哈萨比斯都觉得尴尬

OpenAI研究员宣称GPT - 5找到10个厄尔多斯数学难题解法,引发全网震动。但DeepMind CEO哈萨比斯指出是营销过度,GPT - 5只是搜到已有答案。OpenAI已删稿,此前GPT - 5有一定数学解题能力

量子位
新闻资讯7

OpenAI 的“编程”新范式?其实是瀑布模型的回魂:“听 PM 的话、写需求文档”

在AI工程师大会上,OpenAI研究员Sean Grove提出“规范驱动开发”,认为清晰规范将取代代码成软件开发核心。此观点引发讨论,有人认同,有人反对,也代表了AI编程从“造轮子”到“定方向”的转折。

AI前线
算法论文8

NVIDIA提出小型LLM才是未来,并将重塑Agentic AI

人工智能代理快速渗透企业场景,但当前系统依赖大型语言模型,存在经济成本和效率错配痛点。NVIDIA团队提出小型语言模型才是代理AI未来,论证其能力、经济性和操作适配性优势,并给出迁移路径。

深度学习自然语言处理
开源动态8

太顺手啦,这款开源框架让AI助手秒级接入应用,狂揽20.5K星!再见繁琐AI开发

CopilotKit是基于React的开源框架,开发者能以极简代码将智能助手集成到Web应用。它有三分钟集成、场景感知等优势,具备五大核心功能,适用于多场景,三步即可入门,比同类项目更有优势。

小华同学ai
产品应用8

OpenAI推出云端编程智能体Codex,进一步推动软件工程领域变革

OpenAI昨夜发布研究预览版Codex,一款集成在ChatGPT中的高级编码智能助理。它基于codex - 1模型,支持多种编程语言,有深度代码分析等核心功能,还有codex - mini - latest API版本,或重构软件开发行业。

AI工程化
新闻资讯7

Claude Opus 5被扒光了!1511行提示词底牌全摊开

Anthropic的Claude Opus 5上线当天,系统提示词被开发者Eversmile1传到GitHub。提示词含产品说明、法务合规手册、推销渠道内容。其记忆规则严格,版权引用限制多,商业推荐有不同策略。上线24小时能力被广泛测试。

新智元
开源动态8

世界模型评测的最大盲区,被这个新基准捅破了

过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。

机器之心
8

1分钱部署OpenClaw!不挑设备4步搞定,全图形界面10分钟跑通专属AI助理

OpenClaw是能指挥电脑干活的“数字员工”,但部署复杂。百度智能云推出“作弊级”方案,无需懂代码、折腾环境。限时活动2C4G+200GB服务器首月1分钱,还上线6个核心Skills,让其成普通人生产力工具。

量子位
开源动态8

流式数据集:效率提升 100 倍!

现在只需一行代码,就能通过 `load_dataset('dataset', streaming=True)` 以流式方式加载数据集,无需下载。Hugging Face 优化后端,提升流式数据集速度与效率,减少请求、提升解析速度,还优化启动和流式加载阶段。

Hugging Face