AI News PlatformDaily Report
跟随系统
返回工作台

Daily Report · 数据库生成

2026-06-18 AI 日报

今日收录 5 条经过筛选的 AI 动态。

2026-06-1821:52 生成3 个分类100 条关联资讯

执行摘要

今日收录 5 条经过筛选的 AI 动态。

4 个关键信号

SIGNAL 01

General Intuition in talks to raise $300M at around $2B valuation

据TechCrunch援引知情人士报道,纽约初创公司 General Intuition 正洽谈融资约3亿美元,融资后估值将略高于20亿美元。该公司于8个月前自游戏视频平台 Medal 分拆,并曾完成1.34亿美元种子轮。General Intuition 利用 Medal 每年约20亿条、来自约1000万月活用户的第一人称游戏视频数据,训练具身AI与世界模型,目标不是直接售卖世界模型,而是用其训练可在空间与时间中行动的智能体。报道称,其投资方包括 Jeff Bezos、Eric Schmidt,以及现有投资人 Khosla Ventures 和 General Catalyst;新资金将主要用于扩充算力,并计划在夏末或初秋推出新产品。

SIGNAL 02

Improving health intelligence in ChatGPT

OpenAI发布文章介绍,GPT-5.5 Instant 正在提升 ChatGPT 在健康与 wellness 场景下的回答质量,重点包括更强的推理能力、更好的上下文理解、更清晰的沟通方式,以及基于医生参与的评估方法。对中文 AI 从业者而言,这反映出通用对话产品正持续加强垂直高风险场景能力,尤其值得关注其在医疗健康问答中的评估与安全改进思路。

SIGNAL 03

Using AI to help physicians diagnose rare genetic diseases affecting children

Researchers used an OpenAI reasoning model to help diagnose rare diseases, identifying 18 new diagnoses in previously unsolved cases.

SIGNAL 04

Is it agentic enough? Benchmarking open models on your own tooling

Hugging Face发布一篇面向开发者的实战文章,介绍如何评测开源模型在真实工具链上的“Agent可用性”,不仅看任务是否完成,还衡量完成过程中的时间、token、错误率和行为路径。其核心做法是用一个名为 agent-eval 的CLI评测框架,对不同模型、不同代码仓库版本、不同任务和不同上下文层级(bare/clone/skill)进行并行评测,并结合“marker”机制识别模型是否使用CLI、pipeline等特定行为。以 transformers 为案例,文章发现新增 CLI 与 Skill 后,大模型通常能更快完成任务,但小模型可能因为额外上下文和新接口产生混淆,甚至出现正确率下降与token成本激增。对中文AI开发者的价值在于:它提供了一套可迁移的方法,用来验证自己的库、CLI、文档和示例是否真的更适合Agent使用,而不是只凭直觉优化。

产品

Improving health intelligence in ChatGPT

OpenAI发布文章介绍,GPT-5.5 Instant 正在提升 ChatGPT 在健康与 wellness 场景下的回答质量,重点包括更强的推理能力、更好的上下文理解、更清晰的沟通方式,以及基于医生参与的评估方法。对中文 AI 从业者而言,这反映出通用对话产品正持续加强垂直高风险场景能力,尤其值得关注其在医疗健康问答中的评估与安全改进思路。

OpenAI · 阅读原文

行业

General Intuition in talks to raise $300M at around $2B valuation

据TechCrunch援引知情人士报道,纽约初创公司 General Intuition 正洽谈融资约3亿美元,融资后估值将略高于20亿美元。该公司于8个月前自游戏视频平台 Medal 分拆,并曾完成1.34亿美元种子轮。General Intuition 利用 Medal 每年约20亿条、来自约1000万月活用户的第一人称游戏视频数据,训练具身AI与世界模型,目标不是直接售卖世界模型,而是用其训练可在空间与时间中行动的智能体。报道称,其投资方包括 Jeff Bezos、Eric Schmidt,以及现有投资人 Khosla Ventures 和 General Catalyst;新资金将主要用于扩充算力,并计划在夏末或初秋推出新产品。

TechCrunch AI · 阅读原文

Using AI to help physicians diagnose rare genetic diseases affecting children

Researchers used an OpenAI reasoning model to help diagnose rare diseases, identifying 18 new diagnoses in previously unsolved cases.

OpenAI · 阅读原文

技巧

Is it agentic enough? Benchmarking open models on your own tooling

Hugging Face发布一篇面向开发者的实战文章,介绍如何评测开源模型在真实工具链上的“Agent可用性”,不仅看任务是否完成,还衡量完成过程中的时间、token、错误率和行为路径。其核心做法是用一个名为 agent-eval 的CLI评测框架,对不同模型、不同代码仓库版本、不同任务和不同上下文层级(bare/clone/skill)进行并行评测,并结合“marker”机制识别模型是否使用CLI、pipeline等特定行为。以 transformers 为案例,文章发现新增 CLI 与 Skill 后,大模型通常能更快完成任务,但小模型可能因为额外上下文和新接口产生混淆,甚至出现正确率下降与token成本激增。对中文AI开发者的价值在于:它提供了一套可迁移的方法,用来验证自己的库、CLI、文档和示例是否真的更适合Agent使用,而不是只凭直觉优化。

Hugging Face · 阅读原文

Beyond LoRA: Can you beat the most popular fine-tuning technique?

Back to Articles When you plan to fine-tune a model in a parameter-efficient way, think beyond LoRA If you want to fine-tune an open model on your own data, you are probably interested in so-called parameter-efficient fine-tuning, in short

Hugging Face · 阅读原文

来源引用

01
RT Derya Unutmaz, MD: I’m very excited about this article from @OpenAI on my attempt to use GPT-5 Pro to understand the results of an experiment we d...X:OpenAI (@OpenAI) · 原始资料与分析线索
查看
02
Anthropic is donating another $20 million to Public First ActionAnthropic · 原始资料与分析线索
查看
03
美国政府下令暂停 Anthropic Fable 5 与 Mythos 5 的全球访问Anthropic · 原始资料与分析线索
查看
04
Introducing Claude for TeachersAnthropic · 原始资料与分析线索
查看
05
More details on Fable 5’s cyber safeguards and our jailbreak frameworkAnthropic · 原始资料与分析线索
查看
06
Expanding Project GlasswingWe’re extending Project Glasswing to approximately 150 new organizations in more than fifteen countries.Anthropic · 原始资料与分析线索
查看