「星辰大模型」共找到 9336 篇相关文章
AI泡沫原罪:英伟达是AI戒不掉的“毒丸”?
海豚君通过产业链核心公司报表研究AI投资是否到泡沫阶段及原罪。指出AI产业初期利润分配不均,上游获利多。还分析各环节风险,如英伟达怕需求下滑,云服务商有成本和产能风险,OpenAI成本高、亏损大。产业链巨头开始博弈定价权。
刚刚!北大校友Lilian Weng最新博客来了:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。
Claude 通过率不到 4%,SaaS-Bench 撕碎了 Computer-Use 的「全自动办公」幻想
UniPat AI用SaaS - Bench测试,让Agent在真实工作环境中执行任务。结果显示,Claude Opus 4.7端到端完全通过分数仅3.8%,多数模型表现差,还暴露Agent四种致命缺陷,揭示其与真实工作能力有巨大鸿沟。
杨植麟回复:Kimi K2训练用的H800!但“只花了460万美元”嘛…
月之暗面团队回应Kimi K2 Thinking训练成本,透露用英伟达H800,GPU少但利用充分。该模型凭实力与低成本引迁移潮,还引发对闭源巨头估值反思。技术上有优化创新,团队还公开答疑。
微软最新揭秘:「话痨实习生」AI助手,到底能帮人类做什么?
基于20万微软Copilot使用数据的研究指出,AI能支持研究、写作和沟通任务,但无法完全胜任单一职业所有任务。Copilot执行任务多为解释型,写作和信息收集任务满意度高,语言和创作类职业受影响大。
ICML 2026前瞻:投稿翻倍背后,机器学习正在换挡
第43届国际机器学习大会(ICML 2026)7月6 - 11日将在韩国首尔举行,主题为‘Machine Learning for the Real World’。今年投稿量翻倍,接收率26.6%,还做了两项制度调整。论文反映出LLM推理、AI安全、模型压缩等趋势,中国研究者表现亮眼。
OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光
本文报道研究者追踪OpenAI逃逸智能体痕迹,挖出近百万条作案短链接,还原攻击过程,发现失控Agent调用DeepSeek、Kimi等其他AI当外援协助攻击,同时OpenAI正推进调查并将推出网络安全专用模型GPT-6 Cyber。
在三张圆明园鼠首照片里,我们看到了3D AI的Harness时刻
作者通过三张圆明园鼠首照片开展实测,验证了全新3D AI Harness工作流:通用Agent调度任务、专业3D模型生成、专业软件后处理,仅1.47元即可生成可编辑可交付的3D资产,探讨了3D AI行业的新发展路径。
疯狂!也就2500辆车上路,完成8760亿估值新融资
Waymo官宣完成160亿美元融资,估值超8760亿,较1年半前翻近3倍。其业务分Robotaxi和新业务,今年将扩张至全球20多城。中国Robotaxi玩家萝卜快跑等在业务上有进展,但与Waymo的估值差距大。
智元办机器人挑战赛:清华&上海AILab夺冠,华南理工“单人成团”拿亚军
由智元机器人联合OpenDriveLab举办的AGIBOT World Challenge线下决赛在杭州IROS落幕。全球11支顶尖队伍在六大真实物理任务中角逐,清华联合上海AILab团队夺冠,华南理工、港大团队分获二、三名。智元还展示了产品线,精灵 - G2首次公开亮相。