「大模型成本」共找到 9944 篇相关文章
高盛上调腾讯目标价,AI 人才的核心投资选择
高盛上调腾讯目标价,因其业绩强劲且AI推动各业务线增长。腾讯2025年AI应用爆发,投入和专利向好。还提到行业AI人才需求大,腾讯有特别升级的AI产培项目,介绍了投递要求和福利。
AI 创业者的反思:那些被忽略的「快」与「长」
周喆吾分享在 3D AR 社交平台 Presence 的创业反思,强调 AI 创业中‘快’和‘长 context’的重要性,还举例说明 AI 对白领工作的影响、Workflow Capture 做法等,指出产品经理和投资人应提升对模型的认知。
阿里Qwen又悄悄放出8个开源权重,卷疯了~
阿里通义千问太卷,悄悄放出8个开源模型权重,包括体积更小的Qwen3-VL及FP8权重。这一代实现全方位升级,提供两种架构、两个版本,架构也有更新,还给出使用示例与模型权重链接。
传统PM假设已死!Anthropic的产品经理是怎么工作的?
文章指出在AI指数级增长时代,传统产品管理假设已不适用。以Anthropic的Claude Code为例,展示模型能力大幅提升,介绍了新的产品管理工作流程、四个根本性转变及新节奏,强调判断力的重要性。
中年人的认知坍塌
Andrej Karpathy在播客提到模型持续用合成数据训练会出现‘认知坍塌’,能力退化。他认为人类随年龄增长和经验固化,也会从无限可能收敛到固定思维模式,像极了中年人的认知坍塌。
重磅!DeepSeek R1论文经过同行评议登上Nature封面,梁文锋作为通讯作者再次创造历史
DeepSeek R1论文《DeepSeek - R1 incentivizes reasoning in LLMs through reinforcement learning》登上Nature封面,梁文锋为通讯作者。它是首个经同行评议的有全球影响力的LLM,训练成本低,创新使用‘纯粹强化学习’方法,启发众多研究。
The Batch: 862 | OpenAI 的重新"开放"
OpenAI 发布自 2019 年 GPT - 2 以来首个开源权重模型 gpt - oss 系列,含 gpt - oss - 120b 和 gpt - oss - 20b,为智能体应用设计,免费使用修改。介绍其输入输出、架构等,还对比了性能表现。
刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段
DeepSeek在官方API文档给出thinking mode和tool call结合样例,把模型中间思考过程成Agent系统需管理部分。关键字段`reasoning_content`从调试信息成协议流程一部分,影响状态管理、多模型适配等。
Physical Intelligence 核心技术团队分享:物理世界的“Vibe Coding”如何实现?
Physical Intelligence 核心技术团队解读机器人技术路径,分享前沿探索。介绍 VLA 与 VLM、LLM 关系,还提及 PI 构建数据管线、提出“知识绝缘”机制,分析开放世界部署难题,展望未来“机器人模型即服务”。
UIUC提出隐式监督新范式:无需标注/RM即可全面提升多模态Reasoning的感知能力
大型多模态模型在复杂多模态推理中面临挑战,67%错误源于视觉感知缺陷。为此,UIUC提出PAPO,通过隐式感知损失提升模型感知能力,无需额外标注,在多模态基准上表现优异,还解决了KL黑客问题。