交互范式升级:由“触控/按键”转向“语音、手势、视觉理解、眼动/体感与空间计算”;只要交互成本大幅降低,就有望催生新形态爆品。 底层能力跃迁:端侧AI推理、传感器融合(视觉+深度+IMU)及更高能效的芯片与存储,使设备能“理解你的意图”,而不仅是“响应操作”。 使用场景再定义:从“看视频/听音乐/拍照”扩展为“日常助手化”,覆盖学习、办公、出行、健康管理与家庭中枢等;一旦场景被重构,产品边界也会随之改变。
所以我认为肯定还是有很多机会
浏览器 Agent 的能力差异更多来自:环境感知(页面真实状态)+ 动作执行(可达与可验证)+ 失败恢复的系统设计。云端对话 Agent 的能力差异更多来自:上下文/检索证据整合 + 规划生成 + 工具调用的正确性的系统设计。
浏览器 Agent 的能力差异更多来自:环境感知(页面真实状态)+ 动作执行(可达与可验证)+ 失败恢复的系统设计。云端对话 Agent 的能力差异更多来自:上下文/检索证据整合 + 规划生成 + 工具调用的正确性的系统设计。
交互范式升级:由“触控/按键”转向“语音、手势、视觉理解、眼动/体感与空间计算”;只要交互成本大幅降低,就有望催生新形态爆品。 底层能力跃迁:端侧AI推理、传感器融合(视觉+深度+IMU)及更高能效的芯片与存储,使设备能“理解你的意图”,而不仅是“响应操作”。 使用场景再定义:从“看视频/听音乐/拍照”扩展为“日常助手化”,覆盖学习、办公、出行、健康管理与家庭中枢等;一旦场景被重构,产品边界也会随之改变。
所以我认为肯定还是有很多机会
在垂直领域,肯定是小参数模型超越超大参数大模型,可以了解一下:026 年 8 月 26 日,Google Research 放出 GlucoFM,一个面向连续血糖监测的基础模型。它拿 109,066 小时没人标注过的血糖曲线做自监督预训练,可训练参数只有 0.72M,却在 14 组临床任务评估上压过所有同语料重训的专用基线。