「S1」共找到 1851 篇相关文章
Nature Machine Intelligence颠覆有机化学研究范式,上海交大发表化学合成大语言模型
上交大AI4S团队依托平台,联合多团队在AI for Chemistry领域获突破。相关研究发表于《Nature Machine Intelligence》,介绍白玉兰化学合成大模型Chemma,它加速有机合成全流程,在多任务表现出色,还能解决数据稀疏等问题。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多个问题模拟多任务推理场景。测试发现即便顶级模型如DeepSeek - R1在“高压”下准确率也骤降,该框架能揭示模型差异,为评测提供新范式。
Karpathy戳破强化学习神话,首提AI复盘式进化!暴力试错将死
AI大神Karpathy发文指出强化学习(RL)有局限,效率随任务时长下降,与人类学习机制差异大。他提出复盘式进化Scaling范式,虽有很多细节待完善,但认为还有更多S型增长曲线待发现。
Kimi K2 详测|超强代码和Agent 能力!内附Claude Code邪修教程
作者熬夜带来 Kimi K2 模型详测及 CC+K2 邪修教程。K2 是 1T 参数量的 MoE 开源模型,基准测试成绩优异,在代码、Agent、数学推理任务表现突出,前端能力强,还能驱动 Claude Code,成本低。
Kafka 网络成本失控?如何彻底根除 AWS、GCP 上的 Kafka 网络隐性成本
云原生架构普及,企业将 Apache Kafka 部署到 AWS、GCP 等公有云,跨可用区数据传输成本成“隐形杀手”。AutoMQ 是新一代云原生 Kafka,100% 兼容 Kafka 协议,其“零成本复制”技术可降本,已在 GitHub 开源。
一天 15k 星,代码生成碾压 Claude,连 Cursor 都慌了?谷歌 Gemini CLI 杀疯了
谷歌发布 Gemini CLI,有慷慨免费使用配额,开源且不到一天获 15.1k 星。它连接 MCP 服务器,具备 Agentic AI 能力,接入 Gemini 2.5 Pro 模型,在代码生成等方面表现出色,谷歌认为通用模型更优。
Anthropic:这样构建Agent,性能提升90%!
Anthropic分享从0到1构建多智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货多,涵盖架构设计、Prompt工程等。多智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务。
大树之家团队师生赴希腊参加第一届人工智能与流体力学国际研讨会(AIFLUIDs)
第1届人工智能与流体力学国际研讨会于2025年5月27 - 30日在希腊举办,由多所高校联合筹办,34国超300名学者和近20家科技公司参会。大树之家团队8人参与,作报告获高度关注,加强了学术交流。
Multi-Agent 的灵活编排之路
文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。
Meta重返开源!30B本地Agent塞进24GB显存,LeCun火速力挺
Meta重返开源,推出开源模型Muse Glimmer,参数30B,经量化后一块24GB消费级显卡就能跑通,拥有完整Agent能力。Meta还预告Muse Spark 1.2开放权重版本将发布,扎克伯格称会恢复发布部分开放模型。