个人多模型时代」共找到 8671 篇相关文章

算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。

机器之心
新闻资讯7

Anthropic深夜叫停“无限套餐”!一份万亿Token账单,揭开AI行业烧钱的恐怖真相!

文章以Anthropic叫停‘无限套餐’为例,揭示AI行业烧钱真相。指出‘模型降价能盈利’是错觉,存在‘没人用旧模型’和‘AI Agent耗Token’两大陷阱,还给出三条破局出路。

探索AGI
产品应用7

AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法

在AI驱动的数据应用场景中,企业需同时支撑实时消费、历史沉淀与多引擎复用的数据底座。传统依赖外部ETL作业的流数据入湖方式有诸多问题,本文探讨‘零ETL’趋势,分析Kafka × Table Bucket方案如何降低复杂度。

InfoQ
新闻资讯7

DeepSeek V4真要来了?万亿参数模型匿名开测,免费跑龙虾

推特博主曾‘预示’DeepSeek V4要来,后澄清不确定。今OpenRouter上新‘Hunter Alpha’和‘Healer Alpha’两神秘模型,免费且可跑‘龙虾’,社区对其归属猜测不断,答案待官方揭晓。

机器之心
新闻资讯7

全国首部AI智能体应用评估标准,现公开征集起草单位和个人

2025年成AI智能体元年,国务院提出目标,市场规模爆发增长。但企业部署面临“效能黑箱”,智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草,现公开征集起草单位和个人

AI进修生
算法论文8

Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态大模型

中国科学院计算技术研究所团队提出文本-视觉-语音多模态大模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。

机器之心
开源动态7

MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents

MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。

GitHubStore
算法论文8

微软:LLM上下文学习并非真的学习!

微软研究指出大模型上下文学习(ICL)虽数学上符合学习定义,但只是拟合prompt内统计规律,非掌握任务本质。通过大量实验,得出如例子越多模型表现越好、语言不重要统计重要等7条关键发现。

PaperAgent
产品应用7

面壁MiniCPM4推理速度3倍,碾压同尺寸Qwen3,阿里上眼药了~

面壁发布包含10个模型的MiniCPM4系列,其推理速度快。它有高效模型架构、学习算法、高质量训练数据和推理系统等创新点,还给出了MiniCPM4实战代码及启用InfLLM v2的参数设置。

CourseAI
开源动态8

创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型

开源多模态生成领域获架构级底层突破。上海创智学院与 Sand.ai 联合研发的 daVinci - MagiHuman 正式开源,打破开源界音视频联合同步生成三重局限。它采用单流 Transformer 架构,能力强、推理效率高。

机器之心