长勺智库长勺智库
话题文章任务
登录
LLatent SpaceLatent Space发布于 23 小时前
AI 新闻降温:编码代理与高端模型成本的现实检验

近期 AI 社区热议显示:编码代理并非万能,高端模型虽在复杂任务上更强,但企业采用成本可能显著上升。

360
AIAgent工程实践
360
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
Jev:只做决策、分类、路由与评分的“系统一模型”

TypeSafe 发布 Jev,定位为补充慢速大模型的“系统一模型”,主打快速、低成本、校准决策,而不是聊天、写代码或复杂推理。

400
AIAgent工程实践
400
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
AIUC 融资 4000 万美元:用标准与保险解决 AI Agent 责任问题

AIUC CEO Rune Kvist 谈 4000 万美元 A 轮融资、AIUC-1 标准、AI Agent 安全测试,以及当自主系统出错时的责任与保险问题。

400
AIAgent工程实践
400
AIAgent工程实践
CCloudflare AI BlCloudflare AI Bl发布于 1 天前
浏览器端攻击为何会绕过扫描器

恶意 JavaScript 可在店铺正常运行时劫持点击、窃取佣金或篡改分析。案例显示,持续的浏览器端可见性比一次性扫描更关键。

420
AI工程实践云计算开发者
420
AI工程实践云计算开发者
LLatent SpaceLatent Space发布于 2 天前
AEF-1:第三方 AI 评估标准走向成形

AI Evaluator Forum 发布 AEF-1 基线,围绕第三方评估的访问权限、利益冲突、资金关系与透明度提出要求,呼应前沿模型“降速”争论。

430
AIAgent工程实践
430
AIAgent工程实践
LLatent SpaceLatent Space发布于 2 天前
游戏训练能否迁移到真实工作?

Good Start Labs 尝试用游戏训练 AI:同样是铁路游戏,训练设计不同,模型在金融研究任务上的迁移效果也不同。

450
AIAgent工程实践
450
AIAgent工程实践
CCloudflare AI BlCloudflare AI Bl发布于 2 天前
Cloudflare 推出“禁止 AI 训练”设置:保留搜索收录,拒绝训练抓取

Cloudflare 新增“禁止 AI 训练”控制项,允许网站继续被搜索引擎发现,同时拒绝混合用途爬虫将内容用于 AI 训练。

450
AI工程实践云计算开发者
450
AI工程实践云计算开发者
LLatent SpaceLatent Space发布于 3 天前
Richard Socher的新赌注:让AI自动改进AI研究

NLP先驱、You.com创始人Richard Socher创办Recursive,押注递归自我改进,目标是打造能加速发明与AI研究的“尤里卡机器”。

520
AIAgent工程实践
520
AIAgent工程实践
LLatent SpaceLatent Space发布于 5 天前
DeepSeek V4.1-Flash:面向长上下文的新架构实验

DeepSeek V4.1-Flash采用新的因果编码器—解码器架构,并加入原生视觉理解。其重点不只是跑分,而是更高效地处理上下文与长时智能体任务。

400
AIAgent工程实践
400
AIAgent工程实践
LLatent SpaceLatent Space发布于 5 天前
前线部署工程师为何兴起:它不只是咨询

FDE 正成为 AI 公司热门岗位,但不同公司对其职责理解差异很大。Vinoo Ganesh 以 Palantir、Citadel 与 Kepler 的经历,解释这一角色的定位、误区与组织实践。

440
AIAgent工程实践
440
AIAgent工程实践
LLatent SpaceLatent Space发布于 7 天前
AI 日报:Anthropic 网络安全事件、OpenAI 治理调整与智能体评测进展

本期梳理 Anthropic 安全事件、OpenAI 产品与治理变化,以及智能体评测、模型工具、机器人和本地推理基础设施的新动态。

400
AIAgent工程实践
400
AIAgent工程实践
LLatent SpaceLatent Space发布于 9 天前
前沿模型如何选择推荐对象:AEO 追踪器发布

一个新的 AEO 追踪项目用 6 种提示词变体、7 个前沿模型和 161 个类别,观察 AI Agent 在推荐产品与服务时的偏好。

360
AIAgent工程实践
360
AIAgent工程实践
LLatent SpaceLatent Space发布于 12 天前
试用 Grok Bot 五天:像 MacBook 一样简单的智能体编程

作者试用 Grok Bot 后认为,它与 OpenClaw 的差异不在能力强弱,而在抽象层级:前者更像托管电脑,后者更像用户自有平台。

420
AIAgent工程实践
420
AIAgent工程实践
LLatent SpaceLatent Space发布于 13 天前
GPT-6 Astra 早期体验:AI 工程师能力跃迁

一份早期试用报告称,GPT-6 Astra 在工程、数据、部署与多代理协作中表现出接近“自动化 AI 工程师”的能力。

460
AIAgent工程实践
460
AIAgent工程实践
LLatent SpaceLatent Space发布于 13 天前
GPT-6 Astra 发布:OpenAI 新旗舰模型引发高关注

GPT-6 Astra 发布后迅速获得大量关注。文章称其在计算机使用与编程方面达到新高,单 token 更贵,但按任务成本更低。

420
AIAgent工程实践
420
AIAgent工程实践
LLatent SpaceLatent Space发布于 14 天前
Muse Spark 1.3 发布:性能跻身前列,开放权重即将到来

Muse Spark 1.3 宣称在编码与智能体任务上大幅提升,并将推出开放权重版本;其 API 还提供训练数据授权换取 90% 以上折扣的定价选项。

400
AIAgent工程实践
400
AIAgent工程实践
LLatent SpaceLatent Space发布于 19 天前
OpenAI拟终止Cursor模型直连合作

Cursor被SpaceX收购后,OpenAI计划于11月12日终止其直接模型访问。Cursor称OpenAI模型仅占约5%的用户流量,双方仍在沟通。

480
AIAgent工程实践
480
AIAgent工程实践
LLatent SpaceLatent Space发布于 21 天前
OpenAI Jalapeño 推理芯片亮相:性能功耗比与低延迟成为焦点

OpenAI 公布首款自研推理芯片 Jalapeño 的初步测试数据,称其在真实模型负载下实现更高的每瓦吞吐量和更低端到端延迟,并计划于年底前部署到自有基础设施。与此同时,AI 辅助内核优化也成为这次发布的重要看点。

770
AIAgent工程实践
770
AIAgent工程实践
LLatent SpaceLatent Space发布于 21 天前
英伟达拟以130亿美元收购Hugging Face,GLM-5.3-Flash同步引发关注

AI行业再现重磅交易:英伟达被曝将以130亿美元收购Hugging Face。与此同时,智谱发布GLM-5.3-Flash,提供100万Token上下文、3200亿总参数和180亿激活参数,并采用MIT许可证开放权重。

790
AIAgent工程实践
790
AIAgent工程实践
LLatent SpaceLatent Space发布于 23 天前
吴恩达将 AI Engineering 列为新重点:四类核心能力正在成形

吴恩达近期将 DeepLearning.AI 的关注重点进一步转向 AI Engineering。其判断基于超过 1 万条招聘信息、数十次专家与招聘方访谈、问卷及其他线上数据,并总结出四类关键能力,其中包括 AI 应用构建部署与软件工程基础。

860
AIAgent工程实践
860
AIAgent工程实践
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录