「码上飞」共找到 2160 篇相关文章
忘记大模型,英伟达:小模型才是Agentic AI的未来!
截至2024年末,Agentic AI领域获超20亿美元初创公司融资。NVIDIA研究报告显示,多数Agentic AI场景中,小型语言模型已足够强、更适配、更便宜,LLM-to-SLM迁移是必然趋势。
美国宣战,AI行动计划打响第一枪!「AI+材料」成最新核武器
美国白宫发布《美国AI行动计划》,将「AI+材料」推上国家级战略高度。该计划涉及投资AI赋能科学、构建数据集等五大重点领域,释放材料科学发展机遇信号,中国需全速追赶。
百川开源医疗增强大模型 Baichuan-M2:更符合中国临床诊疗场景,可 4090 单卡部署
百川智能发布并开源医疗增强大模型 Baichuan-M2,以更小尺寸反超 OpenAI 新模型。它可 4090 单卡部署,成本低,在 HealthBench 评测表现佳,免费开源,更适配中国临床诊疗场景。
19.8K star!一款开源可视化工作流调度项目,轻松搞定大数据任务!
Kestra 是开源工作流编排平台,用于处理复杂任务自动化问题。它跑在 JVM 上,用 YAML 配置,支持插件扩展。适用于多种任务调度场景,有配置简单、稳定、容错等特点,安装也容易。
OpenAI新Agent遭中国24人初创团队碾压!实测成本、质量全输惨,海外用户:中国Agent代差领先
昨日凌晨,OpenAI推出ChatGPT Agent新功能,标志其踏入“智能体人工智能”领域。虽官方称该功能性能先进,但实际效果有局限。海外网友对比发现,它被中国24人初创团队产品Genspark等碾压。
快慢Reasoning综述!
大型语言模型在复杂推理任务中有‘无差别计算’缺陷,阻碍其在多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。
MCP很好,但它不是万灵药!真正的技术进步,往往始于祛魅之后的清醒认知
当下AI领域,MCP热度高涨,但它并非万能。文章剖析MCP本质,指出它是统一工具调用协议,与Function Call合作。同时分析其开发难题与市场乱局,强调要理性看待,明确其定位和边界,发挥潜力。
我日常在用的所有 AI 工具,以及在怎么用
作者分享日常使用的 AI 工具及使用方式,指出 2025 年 AI 进入场景拼杀深水区,产品竞争白热化。介绍各工具在生产力和生活场景的应用,如深度整理、查漏补缺等,认为 AI 替代部分工作,渗透率会增加。
SSM+扩散模型,竟造出一种全新的「视频世界模型」
在AI热词不断涌现的时代,斯坦福大学等机构研究将长上下文、状态空间模型、扩散模型等结合,创造全新「视频世界模型」。它用状态空间模型实现长期记忆,还设置局部注意力机制,训练和推理表现出色。
DeepSeek 新模型 R1-0528 悄悄开源,与o3 相当,实测来了。
DeepSeek团队悄无声息地在Hugging Face上开源推理模型新升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性能与o3相当,实测表现不错。