跳到正文

#多模态

今日 0 条
9月29日周二
  1. Microsoft Research62

    微软研究发布 Quine 生物多模态世界模型与研究系统

    Microsoft Research 发布 Quine,一个面向生物学复杂性的多模态世界模型与交互研究系统,连接科学工具、文献、湿实验与研究人员,并由 Quine Fellows 计划向首批科学家开放。

    推荐理由:微软发布生物世界模型系统,与Broad研究所合作验证胰腺癌化合物排序能力,给出早期研究员准入计划。

  2. Latent Space84

    AMD 82亿美元收购World Labs,收购含解决稀疏重建问题的Atlas模型

    AMD宣布以82亿美元收购World Labs。该公司自2024年成立以来已建立领先的AI空间智能能力,包括图像、视频和空间重建模型训练团队,以及通过收购SceniX建设的机器人仿真能力。

    推荐理由:AMD 82亿美元收购World Labs,补齐三维空间智能能力,Atlas模型可预测新视角并解决稀疏重建问题。

  3. Microsoft Research16

    微软亚洲研究院(新加坡)成立一周年:深化研究、合作与人才战略

    微软亚洲研究院(新加坡)于2025年7月成立,作为微软在东南亚的首个研究实验室,致力于连接前沿AI研究与当地生态。过去一年,该实验室围绕下一代AI模型、领域应用及人才培养四大支柱,与EDB、IMDA等政府机构及学术界深化合作。其研究重点包括多模态医疗AI和智能体系统,旨在推动AI在东南亚地区的可靠应用与真实世界影响力。

9月28日周一
  1. AWS Machine Learning Blog47

    使用 Amazon Nova Act 实现合成监控

    Amazon Nova Act 基于多模态大语言模型,通过处理 UI 截图而非 DOM 选择器来执行自然语言驱动的浏览器工作流,在早期企业用例中对浏览器工作流的准确率超过 90%。该方案结合 Amazon Bedrock AgentCore、EventBridge Scheduler 和 SNS,提供全托管的合成监控架构,无需维护脆弱的脚本或浏览器基础设施。

9月26日周六
  1. AWS Machine Learning Blog47

    NarrateAI:在 Amazon Bedrock 上实现生产级大语言模型质量保障

    AWS 发布 NarrateAI 系列第二篇,详解在 Amazon Bedrock 上实现约 99% 数值准确率的五种工程 Techniques。通过自适应管道编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证五层协同,将原始查询转化为经校验的实时响应。约 90% 查询走单次快速路径,复杂查询自动触发并行批处理。

9月24日周四
9月23日周三
9月4日周五
  1. Google Research35

    谷歌发布果蝇完整大脑图谱,创神经连接组学里程碑

    谷歌与 HHMI Janelia 等机构合作发布雄性果蝇大脑及中枢神经系统完整连接组图谱,包含 16.6 万个神经元和 1.25 亿个突触连接,是迄今神经元数量最多的脑图谱。该图谱已标注并通过 Neuroglancer 开源工具公开,可与雌性果蝇数据对比研究求偶与攻击机制。谷歌同时利用 AI 工具 PATHFINDER 加速重构,并将研究拓展至斑马鱼等脊椎动物全脑映射。

7月23日周四
  1. Google Research70

    SymptomAI: 面向日常症状评估的对话AI智能体研究

    Google Research发布SymptomAI论文,报道在13,917名参与者中对比Gemini Flash 2.0 SymptomAI与临床医生的症状访谈和鉴别诊断效果。研究显示SymptomAI诊断更受临床专家偏好,并在低置信度病例中优势更大。结合Fitbit生理信号进一步佐证了部分感染性诊断与免疫反应趋势的一致性。

    推荐理由:原文基于近1.4万人的真实对话数据评估Gemini Flash在症状问诊中的表现,并提供与可穿戴设备数据的交叉验证,可为医疗AI落地提供参考。

1月10日周六
  1. Berkeley AI Research46

    信息驱动成像系统设计

    加州大学伯克利分校团队提出一种基于互信息直接评估和优化成像系统的新框架。该方法仅需噪声测量值和噪声模型,无需重建算法或任务特定解码器。在彩色摄影、射电天文、无透镜成像和显微镜四个领域的实验中,信息估计准确预测了系统性能。