「Opus 4.1」共找到 2979 篇相关文章
AI 的宿命数字
AI在1到50间随机选数时,常选27,还编造推理过程,会根据时间调整算法保证结果为27,也有选42等情况。这或源于人类文化偏见,AI是人类集体记忆镜子,难摆脱宿命。
谷歌最强具身大脑发布!波士顿机器狗瞬间人模人样
Google DeepMind发布机器人推理模型Gemini Robotics - ER 1.6,搭载它的波士顿动力机器狗能精确读仪表数字。该模型是第三代,在空间推理等方面显著提升,还新增读仪表能力,且是谷歌迄今最安全的机器人模型。
击败GPT、Gemini,复旦×创智孵化创业团队「模思智能」,语音模型上新了
近日,由复旦邱锡鹏担任首席科学家的模思智能发布多说话人自动语音识别模型 MOSS - Transcribe - Diarize,性能超 GPT - 4o、Gemini 等。它解决语音领域落地痛点,跑分亮眼,还解决 SATS 方案不足,开放 API 限时免费。
A社你解释下,啥叫Sonnet 5比Fable 5还贵?
Anthropic推出新版性价比模型Sonnet 5,定位为“最能干活”,能力提升但价格暗藏玄机。开发者实测发现,新分词器使Token消耗增加,实际花费可能比Opus还高,且有性能相近但价格更低的替代模型。
把AI 时代最重要的判断力当专业学科训练,专注提升判断力
文章指出AI时代人们多只有“领域内判断力”,判断力可当学科训练。介绍预测大赛中普通人表现超CIA分析师,1小时训练能提升10%准确度,还给出判断力3层栈框架及30天训练清单。
Skills 真的可以帮我干活了:把工单分析变成一个可复用的 Skill
Anthropic推出Skills时未被看好,Claude Code2.1.3版本解决触发难题。作者将工单分析固化成可复用Skills,指出传统思路获取数据难,提出新方案,还对比了Skills和Workflow,强调前者优势。
刚刚,大模型装上「鹰眼」!首创高刷视频理解,谷歌Gemini 2.5完败
面壁智能开源MiniCPM-V 4.5多模态端侧模型,8B参数越级反超72B巨无霸,在多领域达SOTA。它首创高刷视频理解,性能强、效率高、适合端侧部署,还实现多技术创新,是开源端侧多模态AI的革命。
扩散语言模型扛把子LLaDA迎来新版本,数学、代码、对齐能力均提升
中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性能提升,VRPO 为扩散语言模型对齐提供框架。
把本地 AI Agent 接到飞书/微信:一个工具全搞定
cc-connect是开源工具,可把本地AI编程Agent桥接到任意聊天平台。支持10+主流AI Agent、12大聊天平台,有多Agent编排等功能。v1.3.0版更新实用功能,3分钟可完成配置。
去掉 VAE 之后,商汤用 8B 参数重新定义了开源生图的上限
商汤SenseNova U1开源后引发开发者社区关注,它基于NEO - unify架构,摒弃VAE,实现多模态理解与生成原生统一。在多项基准测试中表现出色,还针对企业办公场景优化,成为生产级任务新选择。