长时稳定性」共找到 1301 篇相关文章

新闻资讯7

65亿!OpenAI收购Jony Ive的AI硬件创企,Altman要开始做硬件了

今天凌晨,OpenAI宣布以近65亿美元全股票交易收购Jony Ive参与成立的AI设备初创公司io。Jony Ive将与OpenAI CEO Sam Altman联手打造新公司,合作两年前已开始酝酿。

Founder Park
算法论文8

快手&中科院 | 提出多模态奖励模型:R1-Reward,比SOTA模型提升5%-15%!

多模态奖励模型对提升多模态大语言模型表现至关重要,但现有强化学习算法用于训练存在问题。快手、中科院等团队提出 R1 - Reward,在基准上比 SOTA 提升 5% - 15%,还在快手业务场景成功应用。

AINLPer
算法论文8

绝对零监督Absolute Zero:类AlphaZero自博弈赋能大模型推理,全新零数据训练范式问世

清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。

机器之心
新闻资讯7

一个跑智能体,一个专门找漏洞:Google发布Gemini 3.8双版本

9月2日,Google发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber。前者用于编程等,已稳定上线;后者专用于发现修复漏洞,仅向特定方开放。二者共享基础能力,采用不同安全限制和部署环境。

AIGC开放社区
推荐文章8

Anthropic曝光自家整套,AI原生研发手册

Anthropic 在官方博客发布两篇内部实践文章,《The AI-Native SDLC Playbook》讲 AI 承担多数编码工作软件流程安排,《How Anthropic secures its AI-native software development lifecycle》谈流程自动化后安全体系建设。

CourseAI
算法论文8

用3D几何先验驱动视频扩散,实现更一致的世界生成

视频扩散模型生成新视角视频,现有方法缺显式3D结构。智象未来提出DreamWorld,用3D先验与两阶段框架,结合结构和生成能力,在多基准测试表现领先。

机器之心
新闻资讯7

上周 GPT 和 Codex 各有一个发布,很多人没注意吗?可以解锁 Codex 百万上下文了

最近基模发布多,OpenAI 俩更新被低估忽略。一是 GPT - 5.6 Sol 的 Ultrafast 模式,输出最高达每秒 750 Token,先向少量 API 客户开放;二是 Codex 为其开放百万上下文能力,不过大窗口有代价。

MacTalk
产品应用7

RoboScience机器科学发布轮式仿人形机器人REX G1,打造新一代具身生产力伙伴

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1。它搭载自研VLOA架构通用具身大模型Visics,面向多场景,能在真实世界完成任务闭环,具备多方面优势。

机器之心
新闻资讯7

AI 写代码太快,人类测试跟不上了,Meta 用新方法把 bug 检出率提升 4 倍

Meta 用即(JiT)测试方法提升软件质量,该方法在代码评审期间动态生成测试,在 AI 辅助开发环境中将缺陷检测能力提升约 4 倍,源于代理式工作流兴起及传统测试套件的局限。

AI前线
算法论文7

Transformer与RNN合体,谷歌打下显存门槛,解锁超上下文

谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更文本、降低推理资源门槛,实验显示有良好效果。

机器之心