「工程团队管理」共找到 4404 篇相关文章
群核十五年:一家“被AI重新定价”的公司上市了|甲子光年
群核科技15年后在港上市,其以“酷家乐”在家居设计软件领域渗透高。它正从3D工具商迈向空间智能服务商,早期被低估,如今随AI发展,早期投入成为生产力,转型向机器收费。
罗福莉:Claude订阅封杀龙虾背后,真正的出路不是更便宜的token
Anthropic宣布Claude Pro和Max订阅用户不得将额度用于第三方Agent框架,引发各方反应。Xiaomi MiMo大模型负责人罗福莉指出,当前token计费模式难应对挑战,需更优算力使用方式,还介绍了小米MiMo Token Plan。
AI穿越战争迷雾,72%的准确率化身中东冲突预言家
阿联酋和美国研究人员用中东冲突测试AI推理表现,发现其能看透利益博弈、预判战局演变。AI擅沿客观限制推演,在经济领域敏锐,政治领域较难,整体预测准确率达72%。
ICLR 2026 | 机器人不够聪明?VLMgineer让大模型自己「发明工具」,从设计到使用全自动
宾夕法尼亚大学研究者提出 VLMgineer,一个全自动工具设计与使用框架,利用视觉语言模型和进化搜索,让机器人自主设计并使用工具。该工作已被 ICLR 2026 接收。实验显示,它在工具设计上优于人类提示和现有 Benchmark 工具。
阿里正式批准林俊旸辞职!将成立基础模型支持小组、坚持开源、加大人才投入
Qwen负责人林俊旸突然离职引发关注,阿里官方回应,CEO吴泳铭在内部邮件中称已批准其辞职,还将成立基础模型支持小组,坚持开源策略,加大AI研发及人才投入。
告别死记硬背!SkillRL自动提炼Skills持续进化
大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。
多模态Deep Research,终于有了「可核验」的评测标准
俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到可核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。
前 Codex 大神倒戈实锤!吹爆 Claude Code:编程提速 5 倍,点破 OpenAl 死穴在上下文
前OpenAI工程师、Codex项目早期研发者Calvin French - Owen在播客中锐评代码智能体,他偏爱Claude Code,称其编程提速5倍,优势在上下文拆分能力。他还点出OpenAI与Anthropic产品理念差异,分享上下文管理经验。
姚顺雨腾讯首篇论文:给AI下半场指路“上下文学习”
姚顺雨入职腾讯后首个成果CL - bench,用来测试大模型“从上下文中学习”能力。研究指出当下模型多依赖“过去”知识,无法适应“当下”学习。评测中,十个前沿模型表现不佳,揭示其真实场景应用缺陷。
Claude Code 之父分享 10 大使用技巧
Claude Code 创造者 Boris Cherny 分享团队使用技巧,如并行工作、先规划再动手、更新 CLAUDE.md 等 10 条经验,还提及打造自动化体系、提升 Prompt 水平等内容,强调多用多想提效。