「超并行实验」共找到 3431 篇相关文章
强化学习的两个「大坑」,终于被两篇ICLR论文给解决了
现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。
两周反转:Anthropic「闪电」夺回被Cursor挖走的核心编程大将
本月初 Anthropic Claude Code 两位负责人被 Cursor 开发商挖走,两周后又被聘回。Anthropic 虽烧钱但赚钱能力变强,投资人愿超千亿美元估值投资。Claude Code 增长快,而 Cursor 更新引不满,用户外流。
月之亮剑:万亿参数,造就国内首个 Agentic Model?
月之暗面发布全球首个万亿参数且直接开源的 Agentic Model Kimi - K2,它将 AI 下半场与经验时代理论融合。在测评中表现出色,Kimi 还通过创新方法完成预训练和后训练,并将成果开源,给中国开发者更多自主权。
10项评测痛打GPT-4o!智源重磅开源全球最强具身智能大脑
近日,智源研究院开源具身大脑RoboBrain 2.0 32B版本和跨本体大小脑协同框架RoboOS 2.0单机版。RoboBrain 2.0在多项权威具身智能基准上刷新纪录,RoboOS 2.0创新性集成MCP协议与无服务器架构,二者双擎联动推动机器人迈向群体智能。
曾让 Adobe 豪掷千亿,如今要独立上市了!招股书疯狂点名 AI 150 次,新产品对标 Lovable
网页设计工具开发商 Figma 申请 IPO,招股书提“AI”超 150 次,既视其为“创意加速器”,也认为是“潜在威胁”。该公司业务增长强劲,今年扩展工具库,虽 AI 投入短期内有负面影响,但仍会加倍投入。
Github 轻松斩获 30k+ Star,桌面应用开发太丝滑,Tauri框架能重塑桌面App开发?别错过,抓紧上车
Tauri是开源框架,用Rust后端和本地WebView,打造轻量、高性能、安全的跨平台应用,在GitHub获超30000 Star。它能解决Electron应用体积大、性能慢等痛点,功能亮点多,应用场景丰富。
7B小模型超越DeepSeek-R1:模仿人类教师,弱模型也能教出强推理LLM | Transformer作者团队
Transformer作者之一创立的Sakana AI带来新方法,让教师模型像人类教师一样做启发式教学,根据已知解决方案输出解释。用此方法训练的7B小模型在传授推理技能上比671B的DeepSeek - R1更有效。
孙凝晖院士:集成芯片带来三大科学问题
随着摩尔定律发展放缓,集成芯片与芯粒技术对高性能芯片设计制造愈发重要。孙凝晖院士在2025年度晶上系统生态大会指出,集成芯片是提升性能新路径,但芯粒集成度提升带来三大科学问题。
AI自己给自己当网管,实现安全“顿悟时刻”,风险率直降9.6%
大型推理模型有安全风险,此前监督微调泛化能力有限。SafeKey团队提出创新的SafeKey框架,发现大模型信息“越狱”两大核心,通过双通路安全头和查询遮蔽建模强化模型安全,实验验证其有效性。
The Batch:827 | Claude 4 推动代码生成能力再升级
Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。