谷歌团队通过 FitBit 对近 1.4 万名用户进行了为期 9 个月的 AI 症状检查测试。盲评中临床医生将 AI 诊断列为首选的比例达 53%,显著高于独立医生的 24%。研究核心发现并非「AI 击败医生」,而是揭示了当前消费级大模型仅凭用户输入直接回答的模式存在缺陷。
01
X · @kimmonismus
1 个月前阅读全文
6 年 Web 全栈与 AI 应用落地经验,擅长把模糊的想法快速做成能跑、能上线、能说服人的产品。前端到后端、架构到部署,端到端负责。
来自合作过的同事与负责人。
思远是我们最靠谱的全栈,需求到他手里基本不用操心。AI 产品那波从架构到上线全是他在推,质量稳。
跟他协作很省心,技术判断准,还能从产品角度提建议,不只是接需求。交付节奏也稳。
创业早期能找到这样端到端都能扛的人太难得了。从落地页到后台一把梭,帮我们省了大量外包成本。
从初级到主导落地,每一步都在把能力变成结果。
主导 AI 产品从 0 到 1 全栈落地,负责核心链路架构与性能优化,带 3 人小组。
负责核心业务前端架构与组件库建设,推动性能优化,首屏 LCP 从 3.4s 降到 1.6s。
从需求到上线全流程参与,独立交付多个 B 端后台与对外落地页,支撑业务早期增长。
参与企业级中后台开发,夯实工程化与组件化基础,建立对高质量交付的偏好。
六维能力雷达,加上常用技术栈一览。
原创思考与行业转载,持续记录关于产品、技术与 AI 的观察。
谷歌团队通过 FitBit 对近 1.4 万名用户进行了为期 9 个月的 AI 症状检查测试。盲评中临床医生将 AI 诊断列为首选的比例达 53%,显著高于独立医生的 24%。研究核心发现并非「AI 击败医生」,而是揭示了当前消费级大模型仅凭用户输入直接回答的模式存在缺陷。
从选型到部署的完整复盘:为什么放弃 Contentlayer 转用 next-mdx-remote、SSG 与 ISR 的取舍、Cover Flow 用 Swiper 而非手写、暗色主题防 FOUC 的方案、以及评论系统免后端选型。每一条都是真金白银的时间换来的。
GLM-5V-Turbo 技术报告总结了其在模型设计、多模态训练、强化学习、工具链扩展以及与智能体框架集成等方面的主要改进,使其在多模态编码、视觉工具使用和基于框架的智能体任务中表现亮眼。