新模型Spud」共找到 9258 篇相关文章

产品应用8

文心出的推理大模型,给了我们信心

在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源模型,展现百度全栈 AI 实力。

机器之心
新闻资讯7

Ilya模型要来了?投资人爆料:今年最重要的发布!

a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。

机器之心
新闻资讯7

腾讯混元挖走微软明星大模型团队!一作全员出走,成果已跻身大模型竞技场TOP 10

微软明星大模型WizardLM一作全员加入腾讯混元,最成果Hunyuan - Turbos跻身大模型竞技场TOP 10。此前WizardLM - 2发布不顺,且微软将裁员超6000人,国内大厂正激烈争夺大模型人才。

量子位
算法论文8

MIT研究:大模型加噪声就能替代GRPO/PPO调参

MIT论文提出,预训练模型周围存在大量“专家模型”,只需添加高斯噪声并集成,性能就能比肩甚至超越GRPO/PPO等调参算法。由此启发了RandOpt算法,经测试准确率不错,但也有依赖预训练等缺点。

量子位
算法论文8

用大模型检测工业品异常,复旦腾讯优图算法入选CVPR 2025

AI模型用于工业异常检测获SOTA,相关论文中稿CVPR 2025。复旦大学、腾讯优图实验室等机构研究人员设计基于扩散模型的少样本异常图像生成模型DualAnoDiff,实验显示其性能更优。

量子位
新闻资讯7

AI圈深夜大乱斗!OpenAI、谷歌、Anthropic发布模型,集体翻车?

昨晚,OpenAI时隔六年再次开源`gpt-oss-120b`和`gpt-oss-20b`,Anthropic发布`Claude Opus 4.1`,Google发布Genie 3及写故事书功能。不过OpenAI模型幻觉率高,Anthropic更提升有限。

探索AGI
算法论文8

北大伯克利联手“拷问”大模型:最强Agent也才40分!基准专治“不听话”的AI分析师

北大与伯克利团队推出IDA - Bench基准,模拟真实数据分析场景,解决现有基准无法评估大模型在动态交互中可靠性的问题。测试显示,顶尖大模型成功率最高仅40%,不同模型还暴露多种问题。

量子位
新闻资讯7

独家|浙大00后世界模型创业,完成一轮亿元融资,已在多个产业领域实现交付

2021年浙大陈天润成立魔芯科技,早期围绕AI驱动3D内容生成。2024年底转向3D场景建模和世界模型,走纯隐式方法。团队年轻有优势,已产生收入,完成融资,将推模型,目标是实现‘3D的ChatGPT时刻’。

DeepTech深科技
新闻资讯7

Anthropic将在两周内推出思考模型

据The Information报道,Anthropic将在未来几周推出Claude Sonnet和Claude Opus两款模型,能在「思考」和「工具使用」间切换,还可自动测试纠正代码。虽此前产品有不足,但模型处理复杂任务更出色。

AGI Hunt
新闻资讯7

Show me《指环王》!卡帕西强推大模型评测基准

大神卡帕西宣称Anthropic用《指环王》给大模型评测上强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过测试也引发争议。

量子位