「豆包大模型1.8」共找到 8835 篇相关文章
Karpathy头疼的“AI游戏困境”,被这款15分钟出包的国产神器破解了
8月初Andrej Karpathy指出通用AI做游戏时,LLM无法高效审查工作的弱点。而国产平台Spellcaster能先解析自然语言确定游戏设计,15分钟出包,还内置测试员验证,团队想工程化落地新方向。
深度拆解 Muse Glimmer,24GB 显存跑 30B Agent,Meta 到底做了什么?
昨天,Meta发布约30B参数的多模态Agent模型Muse Glimmer,支持128K级上下文。它采用Apache 2.0许可证开放,有量化版本等。其技术设计围绕显存、上下文管理等问题展开,在多方面做了取舍。
Copilot 创始工程师:大多数 AI 编码“就像开着法拉利去买牛奶一样”
GitHub Copilot 创始工程师 Neel Sundaresan 正构建智能编码工具 IBM Bob,已有 8 万 IBM 开发者使用。他认为多数 AI 编码像开法拉利买牛奶,Bob 会按需调度模型,他还谈及智能体市场变化与风险。
2.4K Star!小米最新开源!覆盖600+语种的语音克隆TTS,40倍实时合成速度!
小米k2 - fsa团队开源OmniVoice,这是支持600 + 语种的零样本语音克隆TTS模型,性能超ElevenLabs v2和MiniMax等标杆,RTF低至0.025,合成速度快40倍,还支持声音设计等功能。
ChatGPT开始预测用户年龄,NSFW内容要来了!
OpenAI于1月20日更新推出年龄预测功能,通过分析用户多方面信息判断是否为18岁以下。网友测试发现猜测较准,这或使NSFW内容限制放宽,不同模型版本情况有别,更新还改进语音和记忆功能。
破除水军机器人!北航团队发布全新对抗性框架SIAMD:用“结构信息”破译机器人伪装|IEEE TPAMI
本文介绍北航彭浩团队发表在TPAMI 2025的文章,提出对抗性框架SIAMD检测机器人。它将用户账户与消息交互组织为异质结构,用结构熵建模。实验显示,其在有效性、泛化性等方面优于基线模型。
谷歌翻译重大更新:实时翻译,全球无障碍交流摩擦苹果
Google搜索产品副总裁宣布Google翻译引入Gemini模型,翻译能力飞跃。更新含顶尖文本翻译、实时语音对话翻译(Beta版)及扩展语言练习功能,适用多平台多语言,谷歌期待用户反馈以优化体验。
FDE半年涨了321%,AI行业现在最缺的不是研究员
Forward Deployed Engineer(FDE)是当前AI招聘市场增速最快角色。2026年2月4日到7月22日,FDE岗位从28个涨到118个,增长321%,占比从2%升至3.6%。介绍了其市场趋势、雇主、职责、技能和经验要求等。
奥特曼小号泄密:OpenAI代码工作100%交给Codex!工程师才揭底Codex“大脑”运行逻辑,碾压Claude架构?
近日,OpenAI工程师揭秘Codex“大脑”运行逻辑,介绍其智能体循环及构建提示词等过程。还提及用1个PostgreSQL主库和50个只读副本顶住8亿用户,同时持续探索数据库性能极限。
Gemini 3来了,Software 3.0也快了
作者认为Gemini 3是目前最好的模型,编程时前端用Gemini 3,后端用Codex。无编程需求时,它也能助力信息处理。Google推出Generative UI,二者结合让我们接近Software 3.0。