2026 年 7 月 11 日,Google DeepMind 开源新一代多模态模型 Gemma 4。该系列采用无编码器(encoder-free)架构,直接以视觉 token 接入语言模型,省去传统视觉编码器,参数量覆盖 20 亿至 310 亿,包含可在手机、笔记本等端侧设备运行的轻量版本。
Gemma 4 以 Apache 2.0 协议开放权重,支持文本、图像输入与多语言对话,并针对长上下文与工具调用做了优化。DeepMind 表示,无编码器设计在降低部署门槛的同时提升了多模态对齐效率,使中小开发者也能在本地硬件上运行具备视觉理解能力的大模型,进一步补齐开放权重阵营的端侧多模态拼图。
2026 年 7 月 15 日,由前 OpenAI 首席技术官 Mira Murati 创办的 Thinking Machine…
2026 年 7 月,全球生成式 AI 监管进入密集落地期。多个主要经济体相继出台或更新关于大模型安全评估、数据合规、深度伪造标…
深度求索的 DeepSeek-V4 自 4 月预览版发布并开源以来,凭借百万 token 上下文与极低推理成本引发关注。官方技术…
2026 年夏季,AI 智能体(Agent)赛道融资持续升温,多家聚焦企业级自动化、编程与垂直行业 Agent 的初创公司宣布完…
7 月,国内首个面向具身智能的大规模开源数据集正式发布,覆盖多品类机器人本体在真实家庭、工厂与仓储场景下的操作轨迹、视觉与力觉信…