「扩展思考模式」共找到 1876 篇相关文章
ChatGPT那一套要过时了?翁荔实测创业首个模型,回合制AI被“原生实时交互”秒了
Thinking Machines推出交互模型TML - Interaction - Small,可实时接收多模态输入并响应,性能超现有实时系统。该模型未开放,计划先有限预览再广泛发布,若开放将为企业带来巨大价值。
ICLR 2026 Oral|中科院团队提出新框架「SparseRL」,深度强化学习可自动生成高性能CUDA代码
中科院计算所团队提出 SparseRL 框架,将深度强化学习引入稀疏 CUDA 代码生成任务。实验显示,在 SpMV 任务上编译成功率提升 20%,执行速度提升 30%。该成果已入选 ICLR 2026 Oral。
ACL 2025 Oral | 你的模型评测搭子上线:Evaluation Agent懂你更懂AI
上海人工智能实验室与新加坡南洋理工大学合作研发 Evaluation Agent,它能按需评估视觉生成模型,有可定制、高效率等优势。框架分提案和执行两阶段,评估结果佳,未来将拓展功能。
别光看 Claude 多厉害!Anthropic 内部拉响警报:“AI 的经济冲击比想象的更危险!”
Anthropic宣布启动‘经济未来计划’,作为‘经济指数’扩展,聚焦深入实证研究、推动数据驱动政策制定、完善经济衡量工具,还将与独立机构合作,现已开放合作申请。
Gemini CLI 重磅更新:现已支持音视频处理,并带来多项体验升级
Gemini CLI 迎来重磅更新,带来多项改进。新增音视频输入(暂未正式开启)、增强 Markdown 功能,集成 VSCodium 和 Neovim,技术栈升级至 Ink 6 和 React 19,还有主题更新、隐私管理等优化。
大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?
大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、长上下文和多模态直接读图等因素。
Replit ARR 突破 1 亿美金,1000 万到 1 亿只用了6 个月
Replit 从在线编程工具起步,借助 AI 能力实现增长。近期宣布 ARR 突破 1 亿美金,从 1000 万到 1 亿仅用 6 个月。它起源于降低编程门槛的愿景,早期营收不佳,2024 年转型后靠 Agent 产品爆发。
免费使用Sora!微软发布Bing Video Creator
今天凌晨微软官网发布Bing搜索引擎新功能Bing Video Creator,由Sora支持,免费提供服务。介绍了使用方法、视频生成规格、注意事项等,还提及防滥用措施及内容溯源信息。目前国区未开放,可用美版。
成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力
信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。
全球闲置算力训个模型,性能媲美R1,老黄天塌了!Karpathy曾投资它
全球首个分布式RL训练模型INTELLECT - 2发布,整合闲置算力完成训练,成本降低,性能媲美DeepSeek - R1。其采用分布式异步强化学习范式,团队开源四大关键组件,还获Karpathy等投资,未来有多项计划。