「代码基座模型」共找到 8824 篇相关文章
对话 Plaud 莫子皓:你还记得 PMF 的感觉吗?
本文是对Plaud中国区CEO莫子皓的采访。Plaud是全球成功的AI硬件Startup,产品大卖。莫子皓分享业务、增长原因,探讨PMF、产品形态迭代、功能亮点,还谈及产品定位、人群、未来计划及进入中国市场决策等。
快手解密「AI印钞机」,首提生成式强化学习出价技术,为平台实现超过3%的广告收入提升
文章介绍快手首提生成式强化学习出价技术,为平台提升超3%广告收入。还阐述广告自动出价挑战及业界方案,介绍快手GAVE和CBD算法破解难题,其团队成果丰硕,未来技术有两大演进方向。
他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!
37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。
字节跳动Seed推出「机器人大脑」Robix:让机器人学会思考、规划与灵活互动
近日,字节跳动Seed团队发布「机器人大脑」Robix,它将推理、任务规划与人机交互整合到单个端到端多模态模型。通过层次化架构分工,它能灵活互动,经三阶段训练,在多方面表现出色,为具身智能体发展奠基。
斯坦福:优化器「诸神之战」?AdamW 凭「稳定」胜出
斯坦福大学 Percy Liang 团队研究指出,虽有不少声称能显著加速的优化器替代方案,AdamW 仍为预训练稳健首选,但矩阵型方法在特定数据–模型比例下优势明显。研究还揭示了现有研究的方法论缺陷。
实测美团 LongCat:快到极致,但是别说追平 DeepSeek
AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。
刚刚,谷歌放出Nano Banana六大正宗Prompt玩法,手残党速来
谷歌 Nano Banana 被网友玩出花样,背后是巧妙提示词的功劳。刚刚谷歌官方公布了该模型六个文本转图像提示,可进行文本生成图像等操作,还给出对应提示模板,不过使用中也存在一些问题。
Anthropic 完成930亿元 F 轮融资,投后估值达 13096亿
Anthropic 宣布完成由 ICONIQ 领投的 130 亿美元 F 轮融资,投后估值达 1830 亿美元。众多顶级投资机构参与,自推出 Claude 模型后增长飞速,业务覆盖多领域,资金将用于扩产、安全研究和国际化。
谷歌“世界模拟器”深夜上线!一句话生成3D世界,支持分钟级超长记忆
谷歌DeepMind发布新一代通用世界模型Genie 3,只需一句话就能生成可实时交互的3D世界。性能大幅升级,支持720P画质等,还能推动具身智能体研究,谷歌期待其助力迈向AGI。
超越人类标注,Meta提出CoT-Self-Instruct:如何用"推理式自进化"重塑LLM训练
大语言模型发展需海量高质量训练数据,传统人工标注困境重重,现有合成数据方法也有缺陷。Meta提出CoT - Self - Instruct,通过推理式自进化生成数据,实验证明其在多个任务上超越人类标注数据。