代码审查系统」共找到 3236 篇相关文章

开源动态8

不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍

英伟达联合多机构推出TTT - E2E方法,在长文本处理上提速显著且性能不打折。它基于标准Transformer,将长文本建模转为「持续学习」任务,核心是上下文压缩,避免额外缓存,代码和论文已开源。

量子位
算法论文8

大语言模型离“数学证明高手”还有多远?斯坦福、伯克利、MIT 团队提出 IneqMath 评测标准

现在很多大语言模型常给出看似正确的结论,但推理过程却有问题。斯坦福、伯克利和MIT团队提出新思路,构建IneqMath数据集及‘AI数学裁判系统’,研究发现很多模型推理不严谨,还给出两个提升准确率的办法。

AI前线
新闻资讯7

Claude第一款AI桌宠硬件,深圳制造

Anthropic的开源项目Claude-Desktop-Buddy,首款AI桌宠硬件用深圳M5Stack的M5StickC Plus。A社选它或因工程师是用户且新款常断货,也因其文档和代码可靠。深圳供应链强,M5Stack调整使命为AI世界准备基建。

量子位
推荐文章7

微软副总裁X上「开课」,连更关于RL的一切,LLM从业者必读

微软副总裁 Nando de Freitas 在 X 上「开课」,分享人工智能教育帖子,从 LLM 的强化学习讲起。内容涵盖无监督、监督、强化学习定论,分布式强化学习系统构建,RL 用于后训练 LLM 等,还介绍单步强化学习与策略梯度及相关技巧。

机器之心
产品应用7

从零开始,教你用Codex搓出属于你自己的第一个硬件。

作者分享用Codex开发久坐提醒猫爪硬件的过程。先与Codex聊需求、写代码,再按其提供的清单买硬件,连线、烧录也靠它指导,还可让它调试动作、操控3D打印,体现AI时代硬件开发的便捷。

数字生命卡兹克
算法论文8

工行x上交大发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成大模型研发新高地。工行大数据和人工智能实验室与上海交大人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
产品应用8

今年最难的机器人Demo,“机器人含量”为0

自变量发布全新灵巧操作系统TwinDex,后训练阶段真机遥操数据为0,机器人就能完成多项精细操作。该系统设计有灵巧性、一致性和可扩展性,降低了对真机遥操数据的依赖,使高质量数据与真机遥操的强绑定松动。

量子位
新闻资讯8

全球首个科研LLM竞技场上线!23款顶尖模型火拼:o3夺冠,DeepSeek第四

Ai2耶鲁NYU联合推出科研版「Chatbot Arena」——SciArena,23款顶尖大模型比拼科研任务,OpenAI o3夺冠,DeepSeek第四。该平台解决通用基准测试在科研场景‘失效’问题,但其自动评估系统猜科研人偏好远未及格。

新智元
算法论文8

AI安全得查祖宗三代?Anthropic登Nature揭秘大模型潜意识传染

Anthropic论文登上Nature,揭示AI模型仅通过纯数字序列就能继承另一模型的危险偏好。研究表明,即使删掉敏感词,隐性信号仍能传递,且代码和推理链也是传染通道,这对AI安全评估提出新挑战。

新智元
产品应用8

解析天花板?TextIn xParse如何为RAG打造「零损耗」知识管道

在AI应用发展中,LLM与RAG系统成核心引擎,但项目落地时模型表现常难达预期,根源在于文档解析质量。TextIn xParse能为RAG打造‘零损耗’知识管道,本文从多方面对其解析能力进行了解读。

深度学习自然语言处理