「人才培养链」共找到 713 篇相关文章
OpenAI重新开源!深夜连发两个推理模型,o4-mini水平,笔记本、手机可跑
OpenAI 自 GPT - 2 后重新开源,此次连发两个推理模型 gpt - oss - 120b 和 gpt - oss - 20b。它们性能达 o4 - mini 水平,可在笔记本、手机运行,有宽松许可等亮点,在多测试中表现出色。
Meta扩张继续!挖走OpenAI 2名多模态AI研发人员,收购语音初创公司PlayAI
据报道,Meta 首席执行官扎克伯格从 OpenAI 挖走 2 名多模态 AI 研发人员,还完成对语音初创公司 PlayAI 的收购。Meta 近期在 AI 人才争夺上攻势猛,想补足短板,其超级智能团队未来表现值得关注。
Anthropic CPO:AI写9成代码后,我们迎来了新噩梦!
本文是对Anthropic CPO Mike Krieger的播客访谈。他谈到AI重塑软件开发,约90%代码由AI编写;还分享产品经理价值、Anthropic战略、Artifact关闭原因等,对AI认知从工具变为战略伙伴。
摩根士丹利如何攻克编程界的“最头疼问题”
金融巨头摩根士丹利开发AI工具DevGen.AI,将旧代码转现代语言,此难题通用工具难解决。该工具今年审阅900万行旧代码,节省28万小时。虽有局限,但降低对旧语言开发者依赖,且不会减少人才需求。
一文解读 LLM Posting-Train技术
文章解读了大语言模型后训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。
一场对话,我们细扒了下文心大模型背后的技术
信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。
Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?
LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。
别高估车企“造人”
今年5月特斯拉停产后搭建Optimus量产线,虽强调FSD算法可复用,却未量产。车企造机器人,优势在供应链管理和生产制造,算法移植效果一般,且面临数据难题,竞赛中暂无通关密码。
用Codex做跨境电商:第四章
文章为《用Codex做跨境电商》第四章,聚焦选品工作流,以Pilates环为例,要核对三个问题有无市场与供应链证据,决定后续行动。交付物为选品卡,强调区分参考Listing、候选产品设想和样品。
诺奖得主刚走,Gemini两大核心叛逃Anthropic!
谷歌人才流失严重,一周内五名顶级研究员出走,Gemini两大核心将入职Anthropic。同时,Gemini 3.5 Pro延期至7月。Alphabet股价下跌,市值蒸发超2000亿美元。原因或是上市期权诱惑和算力分配问题。