「大模型预训练」共找到 9676 篇相关文章
Claude Opus 4.5来了:谷歌把Anthropic逼到了墙角
上周谷歌发布Gemini 3 Pro表现惊艳,今日Anthropic推出Claude Opus 4.5应对。其编程能力强,SWE - bench Verified首超80%,且降价66%。还推出产品更新,开发者可按需选模型。
具身智能能力狂飙,安全却严重滞后?首个安全可信EAI框架与路线图出炉!
具身人工智能发展迅速,但能力与安全出现“脱钩”。上海人工智能实验室和华东师范大学团队撰写论文,为“安全可信具身智能”建立理论框架与蓝图,提出成熟度模型、分析框架等。
吴恩达来信:Buildathon 快速工程挑战赛正式发布!
2025年8月16日将在旧金山湾区举办Buildathon快速工程挑战赛。AI辅助编程重塑软件工程,不同开发者对AI使用程度差异大。DeepLearning.AI与AI Fund携手举办竞赛,让选手限时构建产品。
摩尔线程之后,又一家国产 GPU 独角兽完成上市辅导
6月23日,国产GPU龙头沐曦IPO辅导完成,将提交申报材料。其为异构计算提供全栈GPU方案,产品有曦思N、曦云C、曦彩G系列。曾与书生・浦语3.0合作,2024年交付多个算力集群。此外,国产GPU厂商纷纷IPO。
细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈
香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。
通过逆向工程探秘 Claude Code 背后的运作机制
作者通过逆向工程研究Claude Code内部运作,了解其比Cursor等工具慢且贵的原因。Claude Code注重通用性和安全性,执行任务时多有安全检查,虽增加成本延迟,但更可靠,且在命令行工具中用户体验出色。
华为海思老兵上海创业,拿到亿元投资!
过去两年汽车行业竞争激烈,智能驾驶芯片成关键领域。近日,上海为旌科技完成A2轮融资首次交割,获君信资本1亿元。其创始人郑军是海思老兵,带领公司研发多款芯片,还提出诸多行业见解。
Alibaba开源WebDancer解决DeepResearch复杂信息检索难题
Alibaba开源WebDancer,从数据和训练阶段出发提出端到端自主信息检索代理构建范式。实验中,它在GAIA和WebWalkerQA基准测试表现出色,处理复杂信息检索优势显著。
Veo何止生成视频:DeepMind正在用它模拟整个机器人世界
通用型机器人策略发展带来挑战,传统评估方法有局限,前沿视频模型虽有潜力但面临困难。Google DeepMind团队提出基于Veo的机器人策略评估系统,经实验验证有效,展示了视频仿真评估的可行路径。
叫板华尔街之神!诺奖得主在谷歌眼皮底下组队炒股,CEO亲自叫停
AlphaGo之父Hassabis曾在谷歌眼皮底下拉20个顶尖研究员训练高频交易AI,想挑战华尔街量化之神,与贝莱德探讨合作。后因谷歌CEO叫停,项目停摆。不过如今AI+金融正加速发展。