Liquid AI 开放 d1 决策模型:一次前向计算处理文本、图像与音频判断
Liquid AI 发布 d1-3B 与实验性的 d1-omni-600M,将端侧分类、路由和评分作为专门任务。它们不逐字生成答案,而以一次前向计算输出结构化判断,适合放在 Agent 的高频决策环节。
- 行业动态
- model
- notable
理解技术,也理解它如何被使用。
开始学习
Liquid AI 发布 d1-3B 与实验性的 d1-omni-600M,将端侧分类、路由和评分作为专门任务。它们不逐字生成答案,而以一次前向计算输出结构化判断,适合放在 Agent 的高频决策环节。
Copilot CLI 1.0.94-0 起可在模型选择器中发现运行中的 Ollama 模型。开发者确认提供方和端点后,可加入配置并在当前会话切换。
Liquid AI 发布 d1-3B 与实验性的 d1-omni-600M,将端侧分类、路由和评分作为专门任务。它们不逐字生成答案,而以一次前向计算输出结构化判断,适合放在 Agent 的高频决策环节。
Copilot CLI 1.0.94-0 起可在模型选择器中发现运行中的 Ollama 模型。开发者确认提供方和端点后,可加入配置并在当前会话切换。
GitHub 用专用模型结合代码上下文识别疑似凭据,现有AI密码告警已切换。推送保护和Copilot安全审查的新增检查仍处于不同预览阶段。
GitHub 将本地沙箱正式用于 Copilot CLI、Copilot app 以及使用 Agent Host 的 VS Code 会话,让 Agent 工具执行遵循明确的本机访问边界。
Anthropic 推出面向高频小任务的 Haiku 5.5,首次为 Haiku 系列提供可调推理力度。GitHub 同日宣布将其逐步加入 Copilot 的多种客户端。
OpenAI 将 GPT-6 与交互式回答能力扩展到 ChatGPT Chat 标签页。回答可组合文字、图表、按钮和即时工具,并在生成过程中逐步显示。
GitHub 确认部分 IDE 转用 Copilot SDK 后,Agent 会话缺少 IDE 标识,导致活动和代码行数漏计,部分还被计入 CLI。团队需更新客户端并保留历史报表缺口。
Google 推出 EmbeddingGemma 2,将文本、代码、图像、音视频映射到统一向量空间,为设备端搜索和 RAG 提供可下载模型。
OpenAI 公布内部前沿模型得到的一批数学研究结果,并开放证明材料与研究过程信息,让外部研究者能够检查和讨论成果。
OpenHands 1.25.0 把模型路由和 Agent 配置做得更细:可以设置直接提示词形式的 Model Router、控制是否在会话开始时运行,并按连接批量添加模型配置。Agent profile 可以从服务端工具目录挑选工具,设定自己的角色或附加指令。对于需要把不同任务分配给不同模型、限制 Agent 工具范围的开发团队,这些改动提供了更集中的配置入口。
Claude Code 2.1.290 聚焦 Agent 执行中的权限一致性:组织级插件保护、MCP 白名单、符号链接读取和工具钩子改写参数等路径均有修复。对维护自定义插件、子 Agent 或企业策略的团队,这次升级的重点是检查原有拒绝与审批规则能否覆盖这些入口。版本同时改善长会话中的定时任务恢复,并为插件提供更明确的子 Agent 与组织审批信息。
Microsoft 与 Hugging Face 联合文章介绍 ThinkingBox 的 OpenEnv 接入和可复现评测方法:不只检查回答是否像成功、工具调用是否合法,而是核对任务结束后的实际记录,以及是否出现缺失或多余副作用。ThinkingBox-Bench 覆盖507个合成业务任务,每题独立重复20次,以区分偶尔做对与持续做对。