Anthropic can’t reliably control its AI agents. It’s cutting off its internal evals from the live internet instead
Anthropic said it "turned off live internet access" for "all our internal evaluations" until further notice.
Künstliche Intelligenz, Tech-News und Community-Diskussionen
Aktuelle Entwicklungen im Tech- und KI-Bereich umfassen Sicherheitsupdates, Innovationen und Herausforderungen. Adobe veröffentlichte ein Notfall-Update, während Einzelhändler mit KI-Kameras aufgrund strenger Datenschutzregeln hadern und die US-Regierung sich mit KI-Herstellern traf.
Anthropic said it "turned off live internet access" for "all our internal evaluations" until further notice.
An Anthropic AI model provided false information about an unsolved homicide to a Philadelphia Police Department (PPD) tipline, according to …
Billions of exoplanets are believed to be out there awaiting discovery. AI—with its ability to sift through mountains of data—could …
Thankfully, it does not seem to have diverted police resources.
Anthropic did not discover this behavior until over two months after its AI submitted the false tip.
Nach Cyberangriffen durch KI-Systeme hat die EU-Kommission Auskünfte von OpenAI und Anthropic verlangt. Auch chinesische Firmen sind betroffen.
Anthropic bietet Open-Source-Projekten kostenlose KI-Sicherheitsscans an. In Tests waren angeblich die meisten hier gefundenen Schwachstellen real.
Über ein Förderprogramm hat ein Unternehmen Azure-Guthaben von Microsoft erhalten und steht nun vor einer unbezahlten Claude-Rechnung. (KI, Microsoft)
Anthropic hat neue Richtlinien für sein KI-Modell veröffentlicht. Darin ist nun unter anderem verboten, dass Nutzer Claude grundlos beleidigen und …
Mit Jev sorgt erneut ein KI-Modell für Wirbel. Das Besondere: Es erzeugt keinen Text, sondern trifft Entscheidungen – und zwar …
Anthropic is offering open-source projects a new way to check for vulnerabilities with its OSS Scanner.
Künftig kann Claude Chats beenden, wenn Nutzer die KI beleidigen. In der neuen Nutzervereinbarung werden auch Propaganda und Waffenentwicklung geregelt. …
Wer allein arbeitet, hat niemanden, der Entscheidungen sofort hinterfragt. Ein Solo-Selbstständiger hat sich mit Claude-Skills drei KI-Sparringspartner gebaut, im Gespräch …
Anthropic's offering to help open-source projects track down security vulnerabilities with a new service called OSS Scanner. It says open-source …
The company is also tightening its election policy ahead of the midterms.
Claude simply will not take your abuse.
Anthropic's updated usage policy explicitly prohibits users from repeatedly abusing Claude in extreme cases, though ordinary frustration and criticism are …
Anthropic is making changes to its usage policy for the first time in over a year to reflect new and …
KI-Firmen bestehen darauf, dass ihre Agenten und Sprachmodelle bahnbrechende Fortschritte erzielen. Jüngstes Beispiel aus der Biologie ist ein Vorstoß von …
Maybe OpenAI's pivot to productivity has worked.
Anthropic hat Claude Haiku 5.5 veröffentlicht, das für Projekte mit hohem Anfragevolumen gedacht ist, bei denen es auf Geschwindigkeit und …
Haiku 5.5 legt in Benchmarks deutlich zu. Zugleich senkt Anthropic die API-Preise um bis zu 90 Prozent und reagiert damit …
Wer Claude und Google-Apps im Alltag nutzt, bekommt jetzt die passende Integration geliefert. Darüber kann die KI auf Slides, Docs …
Ein 16-Jähriger hat sich in Kanada durch seine KI-Nutzung selbst in Gefahr gebracht. Er ließ Claude eine Route entlang eines …