「含模量」共找到 1089 篇相关文章
腾讯频繁发大招,这次轮到企业微信了
腾讯近期动作频繁,企业微信迎来大版本更新,有智能助理大圆、记录面聊等功能,还升级了智能“服务总结”和智能文档。这些功能实用性强,解决社群管理痛点,AI 能无缝融入工作流。
Headroom:Netflix 工程师开源的上下文压缩工具,省 token 还是烧 token?
Netflix工程师Tejas Chopra开源Headroom,定位为AI Agent的上下文压缩层,压缩工具输出等内容,有可逆压缩等特性。官方数据显示节省token效果好,但微软工程师实测结果中性偏负面。
英伟达想革光模块的命
AI数据中心建设浪潮推动光模块行情上涨,A股光模块三剑客市值超茅台。但英伟达欲用CPO革光模块的命,将光器件集成到电芯片,与台积电合作推进。这会打击中国光模块集成商,不过短期内光模块仍有市场。
Claude Code 桌面版烂爆了,Anthropic 终于把 “100% AI 编码”演砸了
Anthropic将Claude Code做成桌面应用,本值得期待,然而新桌面版却问题频出,如卡顿、崩溃、自动化功能不稳定等,还出现大量基础功能问题。此前Anthropic宣称代码由AI编写比例高,但产品质量堪忧。
Google大神开源Agent Skills:专治AI偷懒
AI编程工具常偷懒致上线问题多,Google大神Addy Osmani开源Agent Skills,含19个覆盖全流程的技能、7条快捷指令和反借口机制,可通过一条命令使用,支持多种工具。
AI读不懂文档结构?计算所重构Agentic RAG文档推理能力
大语言模型工具使用能力推动RAG进化,现有Agentic Search框架有“结构盲”问题。中科院计算所团队提出DeepRead,将文档结构转化为坐标系统,用两大工具协同实现类人推理,在多数据集验证效果显著。
MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!
AI发展迅猛,现有基准测试难以跟上其步伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖多领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。
来自MiniMax M2.5的震撼 :小尺寸几乎打平opus4.6,巨便宜,巨能干活,速度巨快
MiniMax M2.5正式发布,是优秀国产模型。它专注极致优化,部署方便、价格实惠、性能顶尖。在多项基准测试表现出色,速度提升、成本降低,多维度实现突破,已在MiniMax Agent全面部署。
马斯克说到做到:开源X平台核心推荐算法
X(原Twitter)开源内容推荐Feed on X召回、精排推理、策略代码,模型参数配置较小,应是简化Demo版。召回用双塔模型,精排用双层Transformer,还介绍了系统架构、模型细节等。
Zed 为什么不用自己造 Agent?OpenAI 架构师给出答案:Codex 重划 IDE × Coding Agent 的分工边界
Coding agents 是应用型 AI 活跃领域,但团队常重复构建脆弱基础设施。OpenAI 的 Codex 提出“模型和 Harness 共同构建”,架构师介绍构建挑战与使用模式,还阐述了将模型适配到 Harness 的问题及未来发展方向。