「大模型智能体」共找到 10801 篇相关文章
夸克做ChatBot,为什么是现在?
AI行业曾有“垂直Agent幻觉”误区,重演App时代“功能碎片化”老路。而模型趋势是泛化与整合。10月23日夸克上线“对话助手”,其此时入局是基于技术、竞争和交互形态三重判断,且有模型和系统双重保障。
刚刚,Sam Altman宣布:GPT-5即将发布
Sam Altman在X上宣布OpenAI通用推理系统在2025年IMO达金牌水平,同时透露GPT - 5即将发布。OpenAI研究员Alexander Wei介绍突破细节,模型解决多道题获35分。GPT - 5是实验模型,有金牌能力的版本还需等待。
建模世界偏好:偏好建模中的Scaling Laws
研究首次揭示人类偏好建模遵循Scaling Law,从论坛收集数据在Qwen 2.5模型训练,发现测试损失随训练规模指数增长线性下降。提出建模世界偏好,论文和模型已开源,还探讨了偏好建模可扩展性等问题。
龙虾安全被3层硬核架构焊死了!一份面向开发者的硬核生存指南
随着OpenClaw等高权限智能体应用爆发,AI自主性与失控的赛博博弈开启。文章从源头对齐、边界重构、结果保障三个维度,拆解适应智能体自主行动时代的新型安全框架,为开发者提供生存指南。
英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了
英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在多任务中表现出色,解决了熵崩溃和训练不稳定问题。
深度|开源大战全面开打:老黄+小扎 vs 奥特曼+达里奥
黄仁勋注册X账号分享公开信《Open Weights and American AI Leadership》,25家联署方支持开放权重模型,OpenAI、Anthropic、谷歌三家闭源前沿实验室未签署。信中核心论点是开放权重模型让AI成行业基础设施,还涉及蒸馏等敏感政策争论。
代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相
新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。
最新风口Harness,李开复、陆奇已重金入场
养虾人面临Token费钱、长程任务不靠谱问题,行业浮现Harness群体多智能体解决方案。OpenAI、Anthropic等顶尖玩家发现需更高约束系统。明日新程获陆奇、李开复投资,李笛团队将推新产品,检验群体智能能否走向C端。
不玩PPT拼实战!中国「具身军团」要在上海动真格了
即将于12月12日举行的「GDPS 2025全球开发者先锋大会」,代表上海具身智能生态全面跃迁。上海为具身智能产业提供场景、算力等支持,企业完成从概念到工业级成熟的蜕变,大赛将进行多赛道「实弹演习」。
追赶OpenAI!Anthropic 融资 130 亿美元,估值 1830 亿美元
Anthropic完成130亿美元F轮融资,投后估值1830亿美元。其收入增长快,Claude Code产品表现佳,但约28%收入依赖两大客户。豪华投资方助力扩产等,它正追赶OpenAI,不过竞争挑战大。